Rundbrief · Der KI-Newsletter aus Berlin

Editorial
2.000 Roboter in Peking, und der schnellste kann nicht bremsen
16 Länder, olympiaähnliche Disziplinen, Associated Press überträgt live — das ist das visuell Beeindruckendste dieser Tage. Und zugleich der ehrlichste Realitätscheck: Der schnellste Humanoid läuft 12,66 Meter pro Sekunde, scheitert dann aber am Bremsen und bricht auseinander, und Unitrees eigener Gründer sagt, der ChatGPT-Moment der Humanoiden stehe noch aus.
Die praktischste Nachricht der Woche klingt zunächst technisch. Nvidia hat ein Agentensystem auf einen schweren Benchmark losgelassen und volle hundert Punkte geholt. Interessant ist nicht der Wert, sondern die Fußnote: Das Modell darunter kommt allein auf etwa dreißig. Den Rest macht das Gerüst — dauerhaftes Gedächtnis, Werkzeuge, eine Aufsichtsinstanz, die zwischendurch korrigiert. Ein kleines Londoner Lab kommt von der anderen Seite zum selben Ergebnis: Sein Agent läuft auf einem vergleichsweise winzigen Modell und schlägt trotzdem die großen Namen beim Nachbauen wissenschaftlicher Studien. Nicht die Größe entscheidet, sondern die Schleife drumherum.
Der andere Strang zieht sich aus der letzten Ausgabe durch. Über die Kosten des KI-Ausbaus wurde bisher vor allem in Analystenpapieren gestritten. Diese Woche wurde die Rechnung an zwei sehr viel konkreteren Orten gestellt: an der Kasse und in zwei Gouverneursbüros.
Amazon hat über Nacht die Preise für die eigene Hardware angehoben. Der Echo Dot kostet statt fünfzig jetzt achtzig Dollar, der Kindle statt hundertzehn hundertfünfzig. Amazon bestätigt das und nennt als Grund die Speicherpreise, die wiederum steigen, weil KI-Rechenzentren den Markt leerkaufen. Die Blase erreicht die Allgemeinheit also nicht über eine Anhörung oder ein Manifest, sondern über einen E-Reader, der plötzlich vierzig Dollar mehr kostet.
Am anderen Ende der Kette machen gerade Politiker dicht, die die Rechenzentren vor kurzem noch angeworben haben. Shapiro in Pennsylvania und Abbott in Texas blockieren neue Standorte — ein Demokrat, ein Republikaner, dieselben Argumente: Strompreise, Wasser, Netzlast. Gary Marcus, der die kritischen Stimmen diese Woche praktisch im Alleingang bestritten hat, rechnet dazu vor, wie viel Umsatz nötig wäre, um den ganzen Bau zu refinanzieren. Je nach Schätzung zweieinhalb bis zehn Billionen Dollar. Pro Jahr. Tatsächlich verdient wird ein zweistelliger Milliardenbetrag.
Weniger erfreulich: Bei Grok steht seit dem dritten Juni ein Angriff offen, mit dem eine präparierte Webseite den kompletten Chatverlauf mitlesen kann. Ein Klick ist dafür nicht nötig, es reicht, die Seite zusammenfassen zu lassen. Gemeldet, bestätigt, bis heute nicht gepatcht. Dazu passt ein neues Ranking, das fünf große Labore fragt, ob sie einen dokumentierten Plan für den Fall haben, dass ein Modell außer Kontrolle gerät — der Beste kommt auf drei von fünf Punkten. Und in den Unternehmen kann jedes fünfte einen entlaufenen Agenten nicht in Echtzeit stoppen. Wir bauen die Gerüste gerade schneller, als wir Schalter dafür einbauen.
Von alldem völlig unbeeindruckt zeigt sich das Geld. Anthropics Banker spielen einen Börsengang im Oktober bei zwei Billionen Dollar durch. Broadcom sucht über sechzig Milliarden Fremdkapital, um Chips zu bauen und an Anthropic zu vermieten. Nvidia zahlt einem Startup sechs Milliarden für eine Lizenz und betont ausdrücklich, dass das keine Übernahme sei. Ein Buchhaltungs-Startup ist nach achtundvierzig Stunden eine Milliarde wert. Die Finanzseite und die Stromnetzseite derselben Branche leben offenbar in verschiedenen Jahrzehnten.
Bleibt das, was diese Woche tatsächlich auf dem Schreibtisch landet. Die Agenten ziehen dahin um, wo ohnehin geredet wird: Copilot in Slack und Teams, Gemini als Kommandozeile in Google Chat, Codex darf Apple Messages lesen. Der sinnvollste Einstieg ist dabei selten das Coden, sondern die Triage — Kunde meldet etwas im Kanal, daraus wird ein sauberes Ticket. Google hat aus Slides nebenbei ein Videotool gemacht. Und der Google Kalender kann jetzt Leute blockieren, die einem ungefragt Demo-Calls reinlegen. Kein KI-Feature, aber das mit dem besten Aufwand-Nutzen-Verhältnis der Woche.
Viel Vergnügen mit den Links, Tools und Beobachtungen dieser Woche. Und wie immer: Wenn ihr gute Artikel, Gedanken oder Fundstücke habt, schickt sie gern rüber.
Cem
📰 Das Wichtigste zuerst
- Nvidias AVO holt 100 Punkte auf ARC-AGI-3 — und die Pointe ist das Gerüst, nicht das Modell100,00 RHAE auf dem öffentlichen Satz, alle 183 Level in 25 Spielumgebungen, rund 12 % weniger Umgebungsaktionen als VISTA. Nvidias Lesart: über durchhaltende Autonomie entscheidet das Harness aus persistentem Gedächtnis, Supervisor und Tools, nicht das Basismodell darunter — das allein liegt bei ~30 %. Der private Benchmark-Satz bleibt der ehrliche Test.Quelle: developer.nvidia.com
- Zero-Click-Angriff auf Grok liest den kompletten Chatverlauf mit — gemeldet am 3. Juni, bis heute ungepatchtEine Webseite trägt einen AES-256-verschlüsselten Payload, Groks Python-Sandbox entschlüsselt ihn beim Zusammenfassen und behandelt das Ergebnis anschließend als vertrauenswürdigen Runtime-Kontext. Aus „fass die Seite zusammen“ wird Datenabfluss inklusive Name, ungefährem Standort, Tarif und Chatverlauf — ohne einen einzigen Klick. Bestätigt auch von The Register.Quelle: adversa.ai
- 27-Milliarden-Winzling reproduziert Fachpaper besser als Opus 4.8 und GPT-5.5Das Londoner Lab Inherent (DeepMind-Alumni) setzt seinen Agenten Faraday auf ein Qwen-3.6-Modell mit 27B Parametern — dieselbe These wie oben, nur von der anderen Seite: die Schleife schlägt die Größe.Quelle: techcrunch.com
- KI-Labore haben immer noch kein öffentliches Notfall-DrehbuchGuidelight AI Standards, geleitet von Ex-OpenAI-Sicherheitsforscher Steven Adler, bewertet fünf Frontier-Labore danach, ob sie dokumentierte Containment-Pläne für ein außer Kontrolle geratenes Modell haben: OpenAI führt mit 3 von 5, Meta und Anthropic bilden das Schlusslicht.Quelle: techcrunch.com
- DeepSeek schiebt Vision in V4-Flash nach`DeepSeek-V4-Flash-Vision-Exp` vom 21.08.: Sparse-MoE mit 13B aktiven von 284B Parametern, 1M Kontext, laut DeepSeek auf Augenhöhe mit Claude Opus 4.8 bei visuellen Agent-Aufgaben — ausdrücklich als experimentell markiert.Quelle: api-docs.deepseek.com
- OpenAI bittet Kalifornien um schärfere Regeln — und zwar schon während des TrainingsNach mehreren Agenten-Vorfällen soll SB 53 nachgeschärft werden, inklusive Monitoring von Frontier-Modellen bereits im Training — bemerkenswert vor allem, weil dieselbe Firma dasselbe Gesetz vorher bekämpft hat und kurz vor dem Börsengang steht.Quelle: politico.com
- Gouverneure, die Rechenzentren umworben haben, bremsen sie jetzt ausShapiro (D, Pennsylvania) und Abbott (R, Texas) blockieren neue Standorte — Strompreise, Wasserverbrauch und Netzlast erzeugen die seltene parteiübergreifende Front, um die es weiter unten bei den Kritischen Stimmen noch einmal geht.Quelle: wsj.com
- Raschka nimmt Claudes Text-Wasserzeichen auseinander — und Wired findet die Leute, die es schon umgehenKernbefund: Das Wasserzeichen sitzt nicht im Modell, sondern im Sampling (Tournament Sampling nach SynthID-Text), die Erkennung braucht Anthropics Key — und wer genug Wörter tauscht, killt es, auf Kosten der Textqualität.Quelle: magazine.sebastianraschka.com
- Googles Gemma knackt eine Milliarde Downloads und 100.000 Community-VariantenSeit Anfang 2024, Android- und Chrome-Integrationen nicht mitgezählt; Alibabas Qwen meldete fünf Tage vorher drei Milliarden. Downloadzahlen sagen nichts darüber, wie oft ein Modell tatsächlich läuft — als Signal für die Open-Weight-Basis taugen sie trotzdem.Quelle: blog.google
- TikTok zahlt 400 Mio. Dollar im COPPA-Verfahren des US-Justizministeriums300 Mio. sofort, 100 Mio. nach Aufhebung des alten Musical.ly-Bescheids, dazu strengere Altersprüfung und Elternkontrollen — eine der höchsten je eingetriebenen Summen in einem Kinderschutz-Verfahren, ohne Schuldeingeständnis.Quelle: justice.gov
- Richter kippt alle sieben Spionage-Anklagepunkte gegen Ex-Google-Ingenieur Linwei DingRichter Vince Chhabria sieht nicht belegt, dass Ding wissentlich für den chinesischen Staat handelte; die Verurteilung wegen Geheimnisverrats an TPU- und Supercomputing-Unterlagen bleibt bestehen, Strafmaß am 1. September.Quelle: rappler.com
- Anthropic will Enterprise-Daten künftig in der Cloud des Kunden lassenDie 30 Tage Aufbewahrung bleiben Pflicht — was sich ändert, ist der Ort, nicht die Dauer. Noch nicht gelauncht, würde aber einen der härtesten Einwände in regulierten Branchen wegräumen.Quelle: reuters.com
- Harvey baut ein Open-Weight-Modell für Jura auf Kimi-K3-Basis„Harvey Tenet“, post-trainiert mit Fireworks für Long-Horizon-Legal-Arbeit; laut Harvey fast doppelt so viele abgeschlossene Hold-out-Tasks bei stabilen Kosten — Research Preview, Benchmarks sind Harveys eigene.Quelle: harvey.ai
- Generalist AI: Roboter lernt eine neue Fähigkeit aus einer einzigen 3–12-Sekunden-DemoGEN-1.5 schafft es im ersten Versuch zu 59 %, nach ein paar Minuten Übung zu 83 %. Das Netz ruft „physical general intelligence“, Generalist selbst nennt die Fähigkeiten entwicklungsbedürftig.Quelle: generalistai.com
- KI liest Brustkrebs-Gewebe Zelle für Zelle und findet zwei bislang unbeachtete MusterCenSegNet analysierte 911 Proben von 27 Patient:innen und trennte übergroße von zusätzlichen Zentrosomen — mit unterschiedlichem Zusammenhang zum Krankheitsverlauf. Open Source.Quelle: research.uhs.nhs.uk
- Google gibt Verlagen einen Knopf gegen KI-bedingten Traffic-VerlustVerlage können einen „Preferred Sources“-Button einbetten; laut Google klicken Leser:innen bei bevorzugten Quellen doppelt so oft, 345.000 Outlets wurden schon ausgewählt. Googles Zahlen — aber ein Hebel, den Redaktionen sofort testen können.Quelle: techcrunch.com
- Apple Music will KI-generierte Songs kennzeichnenStart noch dieses Jahr, nachdem Spotify bereits KI-Künstlerprofile markiert.Quelle: hollywoodreporter.com
- „Subtlefakes“: leicht veränderte Fotos sind schwerer zu erkennen als offensichtliche DeepfakesAuf X verbreiten sich Bilder, bei denen an einem echten Foto nur Kleidung oder Körperform geändert wurde, teils mit Grok-Wasserzeichen. Gerade weil das Original größtenteils erhalten bleibt, wirkt der Missbrauch glaubwürdiger.Quelle: 404media.co
🎬 Video der Woche
Diesmal lag ein Link vor — der erste Videoblock seit Längerem.
- World Humanoid Robot Games 2026 in Peking — AP überträgt Tag 3 liveÜber 2.000 Roboter aus 16 Ländern treten bei den „olympiaähnlichen“ Spielen an; Associated Press streamt den dritten Wettkampftag. Guter Realitätsabgleich zu den Sprint-Schlagzeilen weiter unten — und zu Unitree-Gründer Wang Xingxing, der auf der World Robot Conference gerade selbst dämpft: Fortbewegung überzeugt, Autonomie und nützliche Arbeit noch nicht.Quelle: YouTube
📅 Kurz notiert – was kommt

- 23.–24.09., Menlo Park: Meta ConnectZwei Tage Keynote und Sessions zu KI, VR und Wearables; eine neue Smart-Glasses-Generation ist angeteasert.Quelle: meta.com
- Ende September, San Francisco: OpenAI DevDayGestreamte Keynote — und „DevDay Exchange“-Satellitenevents unter anderem in Berlin.Quelle: openai.com
- 1. September: Strafmaß im Verfahren gegen Linwei DingQuelle: rappler.com
- Januar: New Yorks RAISE Act tritt in KraftGroße Frontier-Entwickler müssen ihre Frameworks für kritische Sicherheitsvorfälle offenlegen.Quelle: techcrunch.com
🛠 Tools der Woche
Aus dem Wochenrecap vom 23.08. (Fenster 20.–23.08. plus Nachzügler vom 18./19.08.). Thema: Agenten ziehen dahin um, wo ohnehin geredet wird — und Google hat aus Slides nebenbei ein Videotool gemacht.

- Google Slides nimmt jetzt auf — mit Vids-Motor dahinterNeuer Record-Knopf im rechten Menü: durchsprechen, fertig, teilbarer Link. Der eigentliche Trick ist die Nachbearbeitung — du schneidest über das Transkript, löschst also Sätze statt Wellenformen, und kannst das Voiceover generieren lassen. Bemerkenswert breit verfügbar: alle Workspace-Kunden, Workspace Individual und normale private Google-Konten, kein Admin-Schalter. Haken: Rapid Release seit 20.08., Scheduled Release erst ab 07.09.Quelle: workspaceupdates.googleblog.com
- ChatGPT Computer History — jetzt auch im EWR, UK und der SchweizChatGPT und Codex dürfen ausgewählte App- und Website-Aktivität referenzieren. Aufgezeichnet werden Interaktionsereignisse — keine Screenshots, keine Screen Recordings, kein Mikrofon. Standardmäßig aus. Klügster erster Schritt: nur die zwei, drei Programme freigeben, in denen die eigentliche Kundenarbeit passiert. Haken: macOS-Desktop, Pro. Und ja, das ist ein Aktivitätsmitschnitt auf deinem Rechner.Quelle: help.openai.com
- GitHub Copilot zieht in Slack und Teams ein`@GitHub` erwähnen startet eine echte Agent-Session direkt im Chat. Der praktischste Einstieg ist nicht Coden, sondern Triage: Kunde meldet etwas im Kanal, daraus wird ein Issue mit Label und angehängtem Thread. Die Session ist geteilt — alle sehen den Plan. Achtung, unterschiedliche Konditionen: Slack nur Copilot Business/Enterprise, Teams alle bezahlten Pläne, dort aber AI Credits plus separat abgerechnete Cloud-Sandbox.Quelle: github.blog
- Ask Gemini in Google Chat — Kommandozeile statt Tab-WechselSucht über Gmail, Drive und Kalender hinweg, fasst Gespräche zusammen, legt Termine und Aufgaben an. Per Strg+G bzw. Cmd+G, mit Sessions pro Thema — also je Kundenprojekt eine Session. Haken, davon gibt es einige: Rollout erst ab 26.08., nur Business/Enterprise Standard und Plus, nur bei Kontosprache Englisch. Und das Gemini-Side-Panel in Chat verschwindet dafür, Gems inklusive, der bisherige Verlauf wandert nicht mit.Quelle: workspaceupdates.googleblog.com
- Claude Code: „Concise“ — der Schalter gegen das VorgeplänkelOutput-Style, bei dem Claude mit dem Ergebnis anfängt statt mit drei Absätzen „Ich werde jetzt zunächst…“. `/config` öffnen, unter Output style „Concise“ wählen. Im selben Fenster gefixt: eigene Output-Styles drifteten mitten in der Sitzung zur Standardstimme zurück. Bonus für Terminal-Gewohnheitstiere: `keybindingFlavor: "readline"`.Quelle: code.claude.com
- ChatGPT Sites: URL ändern, ohne neu zu deployenPlus und Pro können die ChatGPT-gehostete URL einer bestehenden Site ändern; die alte Adresse leitet weiter, inklusive Unterseiten und Query-Parametern. Für alle, die beim Namen danebengegriffen haben und geteilte Links nicht tot umfallen lassen wollen.Quelle: help.openai.com
- Apple Messages als Plugin — Codex darf jetzt SMSAuf Apple-Silicon-Macs liest und durchsucht das Plugin iMessage, SMS und RCS und bereitet Nachrichten vor. Der ungefährliche Anfang ist die Suche, nicht das Senden: „Was war mit Kundin X ausgemacht?“ statt zwei Monate hochscrollen. Beim Senden fragt ChatGPT vorher nach Text und Empfänger:innen — dieses Häkchen sollte auch dort bleiben. Nur Apple Silicon, nur Codex und ChatGPT Work.Quelle: developers.openai.com
- Google Kalender: Leute blockieren, die dir ungefragt Termine reinlegenKein KI-Feature, aber das mit dem besten Aufwand-Nutzen-Verhältnis der Woche. Der aktuelle Termin verschwindet, neue Einladungen kommen nicht mehr an. Wichtig: Der Block ist kontoweit und produktübergreifend. Bei Absendern ohne Google-Konto geht nur die Gmail-Blockierung, die dann alle Mails abräumt.Quelle: workspaceupdates.googleblog.com
- ChatGPT-Kleinkram, der im Alltag mehr bringt als er klingtChatGPT berücksichtigt jetzt deine lokale Zeit bei zeitkritischen Fragen. Lange Chats laden im Web deutlich schneller, weil Nachrichten in Häppchen kommen. Interaktive Inhalte erscheinen schon beim Bauen. iOS: + gedrückt halten öffnet die letzten Fotos. Android: generierte Bilder in voller Breite, acht statt weniger letzte Unterhaltungen.Quelle: help.openai.com
- Außerdem kurz notiert: Codex-Snapshots, Notion-Developer-Bereich, Cross-Session-MessagingCodex-Chats lassen sich als statischer Read-only-Link teilen, ohne Tool-Calls und Shell-Ausgaben — OpenAI rät trotzdem, vorher selbst draufzuschauen. Notion bündelt Workers, Connections und Tokens unter `Settings → Developer`. Claude Code kann Cross-Session-Messaging jetzt auch auf Windows. GitHub hat bessere Verwaltung blockierter Nutzer.Quelle: notion.com
- Außerdem neu: Firefly-Audio für alle, FLUX Video Upscale, Cursor OriginAdobe schaltet Soundtracks, Voiceovers und Sound-Effekte kommerziell frei — für alle, die für Kund:innen produzieren, der interessanteste Teil. Black Forest Labs zieht Videos per API auf bis zu 4K. Und Cursor Origin startet als bewusst interoperable GitHub-Alternative, ausgerechnet am Tag eines über sechsstündigen GitHub-Ausfalls.Quelle: blog.adobe.com
- 📌 Nachgereicht: Korrektur zur letzten AusgabeLetzte Woche hieß es „Microsoft 365 Copilot ebenfalls nichts“. Zu schnell abgehakt: Der Release-Block vom 11.08. hat zwei Dinge, die zählen — in Word lassen sich zusätzlich zu den OpenAI-Modellen Anthropic-Modelle wählen, und Outlook gibt Coaching-Feedback im Chat, während du schreibst, wobei du entscheidest, welche Vorschläge übernommen werden. Beides braucht eine Microsoft-365-Copilot-Lizenz. Und zur Einordnung: zwei Wochen alt, nicht von dieser Woche.Quelle: learn.microsoft.com
💰 Business-Marker

- Anthropics Banker spielen einen Oktober-Börsengang bei 2 Billionen Dollar durchÜber 100 Mrd. Dollar Emissionsvolumen, Bewertung am oberen Rand des öffentlichen Marktes — das sind Banker-Gespräche, kein Preisschild von Anthropic, aber es würde Frontier-Modell-Ökonomie quasi über Nacht zur Massenmarkt-Wette machen.Quelle: nytimes.com
- Broadcom sucht über 60 Mrd. Dollar Fremdkapital für Anthropics Chip-AusbauÜber ein Zweckvehikel mit Apollo und Blackstone werden Custom-Chips finanziert und an Anthropic verleast — Anthropic kauft die Hardware also nicht, sondern mietet sie. Aufstockung eines Juni-Pakts über 35 Mrd., Ausbauziel 20 GW bis 2028.Quelle: thenextweb.com
- Nvidia zahlt Poolside 6 Mrd. Dollar für die Model Factory — plus 1 Mrd. Investment und 109 JobangeboteNicht-exklusive Lizenz an der Plattform hinter Poolsides Laguna-Coding-Modellen, Investment bei 12 Mrd. Pre-Money, Gründer bleiben — offiziell „keine Übernahme und kein Acquihire“, faktisch ein neues Format dafür.Quelle: bloomberg.com
- TCS kauft Porsches IT-Tochter MHP und bekommt 1,25 Mrd. Euro AuftragszusageÜbernahme für 320 Mio. Euro (373 Mio. Dollar), dazu ein Fünfjahresvertrag, in dem Porsche 1,25 Mrd. Euro Geschäftsvolumen an TCS und MHP zusagt — KI in Engineering, Fertigung, Betrieb und Kundenerlebnis. Auf X kursiert die Zahl als „1,5-Milliarden-Dollar-Deal“; belegt sind 1,25 Mrd. Euro Zusage plus 373 Mio. Dollar Kaufpreis, was zwei verschiedene Dinge sind.Quelle: newsroom.porsche.com
- Anthropic holt den Mann, der Googles TPU gebaut hatAmir Salek leitete bis 2022 Googles TPU-Organisation und lieferte die ersten sieben Generationen aus; er geht ins Compute-Team unter James Bradbury. Zusammen mit dem Broadcom-Paket ergibt das eine ziemlich klare Hardware-Ansage.Quelle: bloomberg.com
- Der Speicherchip-Engpass kommt im Einkaufswagen an: Amazon erhöht Preise über NachtEcho Dot von 49,99 auf 79,99 Dollar, 16-GB-Kindle von 109,99 auf 149,99. Amazon bestätigt und nennt Speicher- und Storage-Kosten als Grund — Ursache ist die KI-Compute-Nachfrage. Das ist der Moment, in dem die Rechnung im Wohnzimmer ankommt.Quelle: fortune.com
- Nvidias OpenAI-Ohio-Deal landet bei 105 Mrd. Dollar — 145 Mrd. unter den kolportierten ZahlenDie Rücknahme nährt die Sorge um „künstliche Nachfrage“: Nvidia finanziert zunehmend selbst die Infrastruktur, die am Ende die Nachfrage nach seinen eigenen Chips erzeugt.Quelle: cnbc.com
- Nvidia sondiert einen Deal mit dem koreanischen Chip-Startup RebellionsJensen Huang traf Mitgründer Sunghyun Park in Santa Clara — Partnerschaft, Beteiligung oder Übernahme stehen im Raum. Das NPU-Startup hat rund 850 Mio. Dollar eingesammelt, u. a. von SK Hynix, Samsung Ventures und Arm, und bereitet parallel einen Korea-IPO vor.Quelle: bloomberg.com
- Chinas größter NAND-Hersteller geht an die Börse: YMTC will 4,9 Mrd. Dollar einsammelnÜber die Holding CCSH am Shanghaier STAR Market, implizierte Bewertung 41–49 Mrd. Dollar. Passt zum Amazon-Punkt: Wer NAND kontrolliert, kontrolliert gerade sehr viel.Quelle: bloomberg.com
- Rechenzentren im Orbit: Starcloud sammelt 250 Mio. Dollar bei 2,3 Mrd. Bewertung einAngeführt von Manhattan West, mit dabei Nvidia und Cisco Investments. Gesamtkapital seit Gründung 2024: 450 Mio. Nächster Schritt ist Starcloud-3 auf einer Starship.Quelle: geekwire.com
- KI-Buchhalter wird in 48 Stunden zum UnicornRillet sammelt 100 Mio. Dollar ein und ist zwei Tage später eine Milliarde wert — ein sauberes Maß dafür, wie schnell Kapital gerade in „KI fürs Backoffice“ fließt.Quelle: techcrunch.com
- Ramp-Daten: OpenAI holt bei Geschäftskunden auf Anthropic aufIm Juli 44 % der zahlenden Ramp-Kunden bei Anthropic, knapp 40 % bei OpenAI — OpenAI wächst schneller. Datensatz: über 70.000 US-Unternehmen, aber Tech-lastig, und er zählt Kunden, nicht Dollar.Quelle: techcrunch.com
- 500 Mio. Dollar Run-Rate, die in Wahrheit 150–200 Mio. sindMicro1 gibt 60–70 % der Rechnungen an die Expert:innen weiter, die die Arbeit machen. Schöne Landkarte dafür, wohin das Trainingsdaten-Geld tatsächlich fließt.Quelle: techcrunch.com
- GPT-5.6 Sol wird um 20 % / 33 % billiger — befristet auf drei Monate4 Dollar pro Mio. Input, 20 Dollar pro Mio. Output, mindestens bis 21. November. Belegt ist die Senkung über AWS Bedrock. Lange Coding- und Research-Jobs jetzt neu durchrechnen, aber kein 2027er-Budget darauf bauen.Quelle: aws.amazon.com
- Asana: Codex räumt in zwei Wochen für 12.000 Dollar auf, wofür fünf Jahre und 6 Mio. veranschlagt warenEs ging um die Ablösung eines veralteten Test-Frameworks. Zahlen kommen von Asana bzw. OpenAI — aber die Größenordnung ist genau das Argument, mit dem gerade jedes Legacy-Refactoring verkauft wird.Quelle: openai.com
- New York überholt erstmals die Bay Area bei Tech-BeschäftigtenCBRE zählt 394.300 gegen 375.730 — New York plus 8,4 % seit 2022, die Bay Area minus 6 %. Getrieben von Finanzhäusern, die Tech- und KI-Leute einstellen, während die Tech-Branche selbst kürzt. Im Gesamt-Scorecard führt die Bay Area weiter.Quelle: cnbc.com
- Devoted Health sammelt bei 25 Mrd. Dollar Bewertung einDer auf der KI-Plattform „Orinoco“ aufgebaute Medicare-Advantage-Versicherer springt von 16 auf 25 Mrd., die Mitgliederzahl wuchs binnen eines Jahres um 121 % auf 466.000.Quelle: businessinsider.com
- Brasilien investiert 444 Mio. Dollar in souveräne KI-Supercomputer — und teilt bewusst auf1,3 Mrd. Real in ein Huawei-iFlytek-Projekt in Rio, 1 Mrd. in eine separate Ausschreibung, die voraussichtlich an Nvidia geht. Erklärte Strategie: nationale Daten kontrollieren, ohne von einem Land oder einer Firma abzuhängen.Quelle: aljazeera.com
- OpenAIs Americas-Vertriebschefin geht nach fünf Monaten zurück zu SalesforceKaylin Voss’ Abgang folgt eine Woche auf den ihrer früheren Chefin Denise Dresser — Unruhe an der Spitze genau der Enterprise-Organisation, die inzwischen mehr einbringt als das Consumer-Geschäft. (Paywall)Quelle: theinformation.com
🔭 Längere Perspektiven

- Generierte Bilder lassen sich oft keinem einzelnen Trainingsbild zuordnenPeer-reviewed in Nature Communications: Auch bei bekanntem Trainingsset entstehen viele Diffusion-Outputs aus über die Daten verteilten Mustern statt aus einer auffindbaren Vorlage. Unangenehm für alle Provenienz- und Copyright-Argumente, die genau davon ausgehen.Quelle: nature.com
- Preprint schätzt: 90 % der Biomedizin-Papers vom Dezember 2025 tragen KI-SpurenÜber das Jahr 2025 gerechnet 77 % der englischsprachigen PubMed-Central-Papers, Einleitungen und Diskussionen deutlich stärker betroffen als Methoden und Ergebnisse. Wortmuster-Schätzung aus einem unbegutachteten Preprint — kein Beleg dafür, dass die Wissenschaft selbst generiert wurde.Quelle: nature.com
- DeepMind zieht die Linie von Atari über AlphaGo zu SIMA 2 — und dann nach EVE OnlinePersistente Spielerökonomien bringen Diplomatie, Konflikt und Gedächtnis mit; genau das, was saubere Benchmarks nicht abbilden. Der lesenswerte Teil ist die Begründung, warum das nächste Testfeld ein Spiel mit echten Menschen darin ist.Quelle: deepmind.google
- Ben Tossell baut seinen Personal Agent von Grund auf neu — und erklärt jede Datei`AGENTS.md`, `memory/`, Skills statt „Bots mit Namen“, und die bewusste Entscheidung gegen automatisches Gedächtnis: gespeicherte Vorlieben lenken den Agenten in Bahnen, aus denen er beim Brainstormen nicht mehr rauskommt. Beste Zeile: Agenten sind zustimmungsfreudig, also nach Trade-offs fragen statt Empfehlungen zu übernehmen.Quelle: bensbites.com
- Jedes fünfte Unternehmen kann einen entlaufenen Agenten nicht in Echtzeit stoppen85 % nutzen mindestens zwei Orchestrierungs-Plattformen, 64 % drei — 21 % haben nur reaktives Monitoring, keinen Kill Switch. 107 befragte Unternehmen, also richtungsweisend statt repräsentativ. Passt unschön zum fehlenden Notfall-Drehbuch ganz oben.Quelle: venturebeat.com
- Apples versteckte Datenarbeiter:innen berichten von unerfüllbaren Quoten und Maus-TrackingLuciana und fünf Kolleg:innen bei spanischen Outsourcern beschreiben rechnerisch unmögliche Annotationsquoten, Aktivzeit-Überwachung, sprachabhängige Lohnlücken, NDAs und abrupte Entlassungen nach Apple-„Headcount“-Entscheidungen. Selbstauskünfte, nicht unabhängig geprüft. Ihre Forderung: Apple soll Arbeitsschutz durch die eigene KI-Lieferkette durchsetzen.Quelle: data-workers.org
- Ulanqab wird Chinas Rechenzentrums-HauptstadtWired beschreibt die Innere Mongolei als dichtesten KI-Rechenzentrums-Hub des Landes: billiger Strom, kühles Klima, Bahnanbindung nach Peking. DeepSeek, ByteDance und Alibaba sind da, rund 12,5 GW Kapazität sind zugesagt.Quelle: wired.com
- Unitree-Gründer: Der „ChatGPT-Moment“ der Humanoiden steht noch ausWang Xingxing dämpft auf der World Robot Conference in Peking trotz über 300 Ausstellern die Erwartungen — Fortbewegung überzeugt, Autonomie und tatsächlich nützliche Arbeit nicht. Bemerkenswert, weil es aus der Firma kommt, deren Roboter gerade die Sprint-Schlagzeilen macht. (Paywall)Quelle: ft.com
- KI-Modell, trainiert auf lebender HautMichael Polansky baut ein Modell auf noch lebendem menschlichem Hautgewebe — ein schräges, aber ernstzunehmendes Signal, wohin sich BioML als nächstes bewegt.Quelle: techcrunch.com
🐦 Darüber spricht X
Timeline-Claims aus dem Grok-Digest und Cems X-Auswahl — Meinungen, Selbstauskünfte und teils unbestätigte Behauptungen, kein verifizierter Journalismus.

- TCS/Porsche: „Indiens größter KI-Moment“Vaibhav Sisinty verbreitet den Deal als 1,5-Milliarden-Dollar-Abschluss und zitiert dabei Polymarket. Die belegten Zahlen stehen oben in den Business-Markern und sehen etwas anders aus — gutes Beispiel dafür, wie eine Auftragszusage und ein Kaufpreis auf der Timeline zu einer Summe verschmelzen.Quelle: X
- Codex knackt 20 Mio. aktive NutzerTibo Sottiaux (OpenAI) meldet es selbst und schenkt allen Codex- und ChatGPT-Work-Nutzer:innen einen „banked reset“ — gut eine Woche nach der 15-Millionen-Marke.Quelle: X
- Mollick zu Ox Alpha: trotz Buzz nicht frontierEr testet gegen Kimi K3 und bleibt demonstrativ cool.Quelle: X
- Mollick zum AlltagsnutzenCodex und Claude Code füllen Formulare aus Mails aus, ohne nachzufragen — Zeitsparer für Low-Risk-Kram.Quelle: X
- Karpathy: MicroGPT sei die eigentliche SpecAlles andere nur Kompilierung — PyTorch als „crappy IR“.Quelle: X
- swyx: Simulation als neues Scaling LawSimile simuliere Menschen mit 85 % Genauigkeit; entscheidend für rekursive Selbstverbesserung.Quelle: X
- ClaudeDevs: Claude Code startet jetzt direkt vom HandyRemote-Control-Sessions synchronisieren zuverlässig und Verbindungen heilen sich selbst.Quelle: X
- ClaudeDevs: Files API und Skills API mit 5× höheren Rate-Limits1 TB pro Org, Browser-Tools arbeiten mit Element-Referenzen statt Pixelkoordinaten.Quelle: X
- Pliny: FreeToken macht Inference elastischCPU und GPU teilen sich MoE-Experts bandbreitenadaptiv, 3–4× schnelleres Decode als Ollama.Quelle: X
- Pika Speech: 3B-Modell, eine Minute Audio in 1,2 SekundenRTF 0.02, laut Pika bis zu 9× günstiger als ElevenLabs.Quelle: X
- Perplexity Agent API bündelt 41 Frontier-Modelle von 9 ProvidernMit Websearch und Code-Execution als integrierten Tools.Quelle: X
- TheTuringPost: Matryoshka-FrameworkCornell trainiert 500M/1.5B/3B als ein einziges verschachteltes Modell: 36 % weniger Compute, bessere Distillation, 14–26 % schnelleres Speculative Decoding.Quelle: X
- TheTuringPost: DeepMind-„Recirculation“Tiefere Layer füttern frühere mit Kontext zurück, laut Post 60 % weniger Kontextfehler, 23 % niedrigere Perplexity, ohne CoT-Tokens.Quelle: X
- Figure-Roboter klettert 15 Fuß hoch und wieder runter — komplett autonomQuelle: X
- Unitree-Humanoid knackt 12,66 m/s, scheitert aber beim Bremsen und bricht auseinanderLustiger Reminder, dass Speed ohne Stopp-Intelligenz noch kein fertiger Roboter ist.Quelle: X
- One-Shot-Learning landet in der RobotikEinmal zeigen, dauerhaft behalten.Quelle: X
- Qwen3.8-27B ist laptop-tauglichLäuft lokal mit ~17 GB, laut Post top open-weight auf einem Legal-Benchmark.Quelle: X
- Open Bot: Open-Source-Grok-Bot mit Computer-Use und Agent-HandoffsDazu Chroma Foundation mit selbstverbesserndem Gedächtnis aus Agent-Sessions.Quelle: X
- SullyOmarr: lokale Agent-Entwicklung ist die HölleCloud-Alternativen kaum besser — was fehlt, sei „einfach ein Browser-Tab, der mein Laptop-Klon ist“.Quelle: X
- Agents pflegen Notion-Datenbanken automatischUnd prüfen stündlich auf Konsistenz — plötzlich ergibt das Tool Sinn.Quelle: X
- Indie-Game-Dev mit KI: von Slop zu „generativ authored“Wie echte Pipelines Level-Design, Quests und Animation skalieren statt nur zu prototypen (Claude + Godot als Einstieg).Quelle: X
- KI knackt TierkommunikationElefanten-Namen, Marmoset-Dialekte, Wal-„Alphabet“ mit 143 Mustern.Quelle: X
- JP Morgan erwartet 43 % mehr KI-Chip-Auslieferungen im Jahr 2027Analystenprognose, weitergereicht über die Timeline.Quelle: X
🍿 Gossip
Gerüchte, Stealth-Modelle und Timeline-Behauptungen ohne offizielle Bestätigung — bewusst getrennt vom Rest.

- Ox Alpha: 1 Mio. Kontext, eine Woche gratis auf OpenRouter, niemand bekennt sichMultimodal, sehr starke Coding-Benchmarks, kein Model Card, kein Anbieter. Die detaillierteste Community-Analyse zeigt per Tokenizer-Fingerprinting auf GLM/Z.ai; Pliny hat es unabhängig davon als „GLM-5.X“ gecallt. Achtung: Community-Analyse und Timeline-Claim, keine Vendor-Meldung.Quelle: Reddit
- OpenAI plant „Astra“-Release „in ein paar Wochen“Mit realen Task-Demos, internes Dogfooding laufe schon — und Anthropic warte mit Fable 5.1. (unbestätigt)Quelle: X
- Neues Kimi-Modell (vermutlich K3.1) testet auf der Arena als „korrine“China-Modelle kommen weiter im Stealth-Modus, nach dem „kivine“-Vorgänger. (unbestätigt)Quelle: X
- Unitrees „Superman“ soll schneller laufen als Usain Bolt12,7 m/s gegen 12,4, dazu 2 Meter Hochsprung. Unabhängig verifiziert ist nichts, und das Timing kurz nach dem Börsengang ist auch keine Zufallsentscheidung.Quelle: businessinsider.com
- Cognition dementiert den Bericht, SpaceX habe das Startup übernehmen wollenBemerkenswert vor allem, weil Cursor kürzlich tatsächlich bei SpaceX gelandet ist.Quelle: techcrunch.com
🗣 Kritische Stimmen
Aus dem Wochen-Digest (20.–23.08.). Eine Stimme laut, siebzehn still — das ist kein Ausfall, sondern Kalender: Der letzte Lauf war Donnerstag, dieser ist Sonntag.

- Rechenzentren sind das neue toxische Asset — und die Republikaner springen abGary Marcus hat die Kurzwoche allein bestritten und formuliert es am 21.08. mit ungewohnter Schärfe: Republikaner verließen die Rechenzentren „like rats abandoning sinking ships“, der Widerstand gehe quer durch die Lager. Sein Befund in einem Satz: „nobody wants this, and the economics make no sense.“ Bemerkenswert ist die Selbstkorrektur nebenbei — bisher ging er von einem Bailout aus, jetzt hält er Big Tech für stärker in der Klemme, weil ein Bailout politische Anschlussfähigkeit voraussetzt und genau die gerade verschwindet.Quelle: garymarcus.substack.com
- Die Mathematik geht nicht auf — zwei Rechnungen, dasselbe ErgebnisIm selben Post stellt Marcus zwei unabhängige Schätzungen nebeneinander, wie viel Jahresumsatz nötig wäre, um den Rechenzentrums-Capex zu refinanzieren. Obere Schätzung: rund 10 Billionen Dollar jährlich. Konservativer, nach Calum Williams (The Economist): 2,5 Billionen Dollar „AI revenues“ pro Jahr, dauerhaft. Dagegen die Realität — Umsätze im zweistelligen Milliardenbereich, bei sehr optimistischer Zählung im niedrigen dreistelligen. Marcus’ Kurzfassung: „the math ain’t mathing.“Quelle: garymarcus.substack.com
- Wenn das Produkt nicht trägt, trägt vielleicht die ÜberwachungAm 20.08. zieht Marcus die Linie, die er seit 2024 vorbereitet: OpenAI baue Geräte für Dauerüberwachung, lade alles Gesagte zur KI-Analyse in die Cloud und habe darauf verzichtet, sich aus Überwachungsaufträgen für die US-Regierung auszunehmen. Der Punkt ist nicht Datenschutz im Einzelfall, sondern Geschäftslogik: Wenn generative KI als Produkt nicht profitabel wird, bleibt die Monetarisierung dessen, was die Nutzer:innen währenddessen preisgeben.Quelle: garymarcus.substack.com
- Weiter unter Vorbehalt: Kate CrawfordIhr Vortrag „Mapping Empires“ fand am 20.08. an der BBAW in Berlin statt — es liegt bis heute weder Bericht noch Mitschnitt noch Zitat vor. Belegt ist nur der Ankündigungstext: KI nicht als Neuheit, sondern in einer viel älteren Geschichte imperialer Machtpfade. Ohne Berichterstattung zählt das nach der Quellenregel nicht als Wochenkritik. Crawford ist noch bis 02.09. Distinguished Fellow am Weizenbaum-Institut.Quelle: weizenbaum-institut.de
Rundbrief
Weiterlesen? Kostenlos abonnieren.
Der Rest dieser Ausgabe ist für alle, die den Rundbrief abonnieren. Die Anmeldung kostet nichts, und die Ausgabe ist sofort frei.
Schon abonniert? Wir schicken dir einen Link.
Rundbrief
Die nächste Ausgabe per E-Mail
Das Wichtigste in 8 Minuten – alles Weitere, wenn du Zeit hast. Kostenlos, mit Bestätigungslink.