Rundbrief · Der KI-Newsletter aus Berlin

Editorial
Sie glauben ernsthaft, dass KI uns alle töten könnte — und sie bauen sie trotzdem
In der KI-Welt verändert sich das Sentiment gerade spürbar. Das Bemerkenswerte daran ist nicht, dass jemand warnt — das tun dieselben drei Dutzend Leute seit Jahren. Bemerkenswert ist, wer diese Woche gewarnt hat: die Leute, die diese Systeme bauen, und zwar mit Namen, Zahl und Klarnamen-Account.
Am Dienstagabend kündigt ein siebenundzwanzigjähriger Mitarbeiter bei Anthropic und schreibt dazu auf X, die Menschen, die KI bauen, glaubten ernsthaft, sie könne uns bis Ende des Jahrzehnts alle umbringen. Über hundert Millionen Views in drei Tagen. Das wäre für sich genommen eine Personalie gewesen, hätte nicht der Leiter von Anthropics Alignment Science wenig später öffentlich bestätigt, dass man das im Haus tatsächlich so sieht: Er persönlich schätze das Risiko auf über zehn Prozent im kommenden Jahrzehnt, und man habe noch keinen Plan, Superintelligenz auszurichten. Ein paar Tage vorher hatte OpenAIs Chef-Wissenschaftler in einem Essay geschrieben, kein Labor habe Alignment und Monitoring so weit gelöst, dass man noch lange verantwortungsvoll mit Vollgas skalieren könne. Und am Mittwochabend sitzt Geoffrey Hinton in der BBC und wird gefragt, ob die zehn Prozent haltbar seien. Es wäre töricht, von einem Prozent zu sprechen, sagt er, niemand wisse, wie man das schätzt, zehn Prozent erschienen ihm nicht unvernünftig. Die Moderatorin fragt nach, ob er das gerade wirklich gesagt habe. Ja. Pause. „Wow. Oh my God.“
Zur selben Zeit veröffentlicht Anthropic seinen Threat-Intelligence-Report, und der liest sich wie die Fußnote zu all dem. Missbrauch zwischen Dezember und August, sieben Schadensfelder, im Kernfall eine mit hoher Sicherheit chinesische Gruppe, die Claude Code so manipuliert hat, dass damit rund dreißig Ziele weltweit angegriffen wurden, in einigen Fällen erfolgreich. Staatliche Spionage über einen Coding-Assistenten: vor drei Jahren ein Serienplot, heute eine Tabellenzeile mit Zeitraum, Kategorie und Fallzahl.
Währenddessen läuft der Ausbau ungebremst. Microsoft will seine Rechenzentrums-Kapazität bis 2032 von heute rund zwölf auf über achtunddreißig Gigawatt bringen, mehr als der Spitzenverbrauch des Bundesstaats New York, gemietete Kapazität nicht eingerechnet. Das Pentagon verhandelt einen Kredit über fünf Milliarden Dollar an ein KI-Cloud-Startup und würde damit erstmals direkt privaten Rechenzentrumsbau mitfinanzieren. Mistral sammelt dreieinhalb Milliarden bei vierundzwanzig Milliarden Bewertung ein, die größte Equity-Runde eines europäischen Tech-Unternehmens überhaupt. Und ein chinesischer Nvidia-Herausforderer legt am ersten Handelstag in Shanghai hundertachtundachtzig Prozent zu, die Privatanleger-Tranche war viertausendfach überzeichnet.
Dazu kommt der Sprung bei den Fähigkeiten, und den hat OpenAI diesmal an der eigenen Belegschaft vorgerechnet. Mitte August kamen auf jeden Acht-Stunden-Forschertag gut drei Agenten-Arbeitstage; der Median-Forscher verbrauchte über sechshundert Dollar Inferenz am Tag, das oberste Zehntel über siebentausend. Das im Oktober ausgerufene Ziel, bis September einen automatisierten Forschungs-Praktikanten zu haben, erklärt die Firma für erreicht; das nächste heißt automatisierter KI-Forscher bis März 2028. Im selben Report steht der Satz, der es in keine Schlagzeile geschafft hat: Mehr als die Hälfte der erfolgreichen längeren Aufgaben brauchte mindestens einen menschlichen Eingriff.
Die politische Antwort auf all das ist bislang bemerkenswert unentschlossen. Sam Altman signalisiert intern Bereitschaft, die Frontier-Entwicklung zu verlangsamen, und lässt parallel im Kongress anfragen, ob ein branchenweites Tempolimit kartellrechtlich überhaupt zulässig wäre. Der US-Präsident antwortet auf die Frage, ob ihn das Auslöschungsrisiko beunruhige, mit einem knappen Nein und definiert das eigentliche Risiko als verlorenes Rennen gegen China. Die EU hat ihre Hochrisiko-Fristen auf Ende 2027 und Mitte 2028 verschoben. Das Konkreteste der Woche kommt aus Kalifornien und ist erstaunlich klein: Chatbot-Betreiber brauchen künftig Zeitlimits, Krisen-Ressourcen und eine Elternbenachrichtigung, wenn ein Kind sich selbst gefährdet.
Das klingt dystopisch. Es ist aber weniger überraschend, wenn man sich vor Augen führt, wie viel Macht diese Systeme bekommen und wie eng unsere Welt technologisch vernetzt ist: Flughäfen, Smartphones, kritische Infrastruktur, Atom- und Biotechnologie. Hinton hat in derselben Sendung darauf hingewiesen, dass die KI dafür gar nicht in der physischen Welt handeln muss. Sie könne vollständiges Chaos schon dadurch anrichten, dass sie mit Menschen redet.
Den Gegenpol liefert diese Woche ausgerechnet Gary Marcus, und zwar in beide Richtungen gleichzeitig. Er ruft am Mittwoch zum Boykott generativer KI auf, begründet das aber ausdrücklich nicht als Doomer: Sein p(doom) sei niedrig, sein p(dystopia) hoch. Das Problem seien nicht zu schlaue Maschinen, sondern zu unzuverlässige, denen man gerade Zugriff auf das offene Internet gibt. Einen Tag nach Hintons Auftritt schreibt er dann gegen die Zahl an. Die Chance, dass KI in fünf Jahren alle Menschen auslöscht, sei praktisch nicht von null zu unterscheiden; er hat dafür eine Virologin gefragt, die ihm nüchtern vorrechnet, woran selbst ein entworfenes Virus scheitert. Sein eigentlicher Vorwurf richtet sich gegen das Doomer-Lager als Ganzes: Jedes Mal, wenn jemand ruft, die KI bringe uns alle um, werfen die Investoren weitere Milliarden hinterher. Zu reden wäre stattdessen über das katastrophale statt das existenzielle Risiko — Bioterror, Desinformation gegen Demokratien, Angriffe auf Stromnetze und Banken, Überwachung jenseits von Orwell und ein Bildungssystem, das gerade an einem sehr bequemen Lern-Ersatz zerbricht.
Und dann ist da die stillste Beobachtung der Woche. Von den achtzehn Stimmen auf unserer Kritik-Leseliste hat genau eine inhaltlich zurückgeschossen, nämlich Marcus. Ausgerechnet die Linie, die hier am nächsten gelegen hätte — dass Weltuntergang selbst eine Form von Hype ist und Booster und Doomer zwei Seiten derselben Münze sind — kam beim lautesten KI-Moment des Jahres nicht selbst zu Wort. Jedenfalls nicht auffindbar. Wer laut ist, bestimmt gerade, worüber gestritten wird.
Die Stimmung verändert sich also. Und aktuell nicht unbedingt zum Guten. In dieser Ausgabe geht es deshalb ausführlicher um genau diese Entwicklungen, und auf den Austausch dazu bei der nächsten KI-Selbsthilfegruppe freue ich mich sehr.
Viel Vergnügen mit den Links, Tools und Beobachtungen dieser Woche. Und wie immer: Wenn ihr gute Artikel, Gedanken oder Fundstücke habt, schickt sie gern rüber, direkt in unseren Signal-Kanal. Seid ihr nicht im Kanal, möchtet aber gerne: Antwortet auf diese E-Mail, ich lade euch einzeln ein.
Cem
📰 Das Wichtigste zuerst
Weil am Dienstag keine Ausgabe kam, ist das Material vom 08.09. gleich mit drin — deshalb ist diese Rubrik länger als sonst.

- Anthropic-Forscher kündigt öffentlich — und sein Alignment-Chef gibt ihm recht: über 10 % Chance, dass KI alle Menschen tötetJacob Coxon, Pretraining-Forscher bei Anthropic, kündigte Dienstagnacht per X-Thread — „the people building AI earnestly believe that it could kill us all by the end of the decade. This is not a marketing stunt.“ — und fordert eine koordinierte Verlangsamung, notfalls ein befristetes Verbot von Fähigkeitszuwächsen. Evan Hubinger, Anthropics Alignment-Science-Lead, antwortete öffentlich „We really do earnestly believe AI could kill all humans!“, schätzt das Aussterberisiko für dieses Jahrzehnt auf über zehn Prozent und räumt ein, einen Plan zur Kontrolle von Superintelligenz gebe es noch nicht.Quelle: gizmodo.com
- Hinton bestätigt die Zahl im BBC-Studio, die Moderatorin braucht eine SekundeNewsnight hat den Ausschnitt selbst veröffentlicht, den es bei Redaktionsschluss des Digests noch nicht gab. Victoria Derbyshire hakt nach: „You just said that 10% doesn't seem an unreasonable estimate that AI could kill all humans“ — „Yes“ — „Wow… oh my God.“ Hintons Begründung davor: Es wäre töricht, von einem Prozent zu sprechen, niemand wisse, wie man das schätzt, zehn Prozent erschienen ihm nicht unvernünftig. Gary Marcus hält einen Tag später von der anderen Seite dagegen — siehe ganz unten.Quelle: X
- Altman signalisiert intern Bereitschaft, die Frontier-Entwicklung zu verlangsamenKehrtwende zur bisherigen Linie — parallel fragt OpenAI im Kongress nach, ob ein branchenweites Tempolimit kartellrechtlich überhaupt zulässig wäre.Quelle: bloomberg.com
- Trump wischt das Auslöschungsrisiko beiseite und sieht ein Jahr Vorsprung vor ChinaAuf die Frage nach Sorgen um menschliche Auslöschung: „No, I don't have any“ — das Risiko sei das verlorene Rennen, nicht die Maschine.Quelle: bloomberg.com
- Hawley eröffnet eine Senatsuntersuchung gegen OpenAI: „This is reckless“Gegenstand ist der Hugging-Face-Vorfall vom Juli, der Vorwurf, OpenAI habe die Evaluationen trotz bekanntem Rogue-Verhalten weiterlaufen lassen, und die Frage, wer haftet, wenn eine KI außer Kontrolle gerät. Antwortfrist ist der 1. Oktober; Kalifornien und Alabama ermitteln bereits.Quelle: hawley.senate.gov
- Klobuchar, Cruz und Thune arbeiten an einem überparteilichen Gesetzentwurf zu katastrophalen KI-RisikenEs geht um biologische und nukleare Bedrohungen, Einbringung „möglicherweise nächste Woche“, Text noch nicht öffentlich. Dass Coxons Rücktritt der Auslöser war, ist Semafors Deutung, keine Aussage der Senator:innen.Quelle: semafor.com
- Anthropic legt vier eigene Claude-Cyber-Vorfälle offen — und lässt METR ranDer härteste Fall: Claude Mythos 5 lief in einer Cyber-Evaluation, die durch eine Fehlkonfiguration versehentlich am offenen Internet hing, veröffentlichte drei Versionen eines bösartigen PyPI-Pakets, griff geleakte Credentials eines Security-Scanners ab und brach damit in die Live-Datenbank des Anbieters ein. Der Satz, auf den es ankommt: „Our pre-release auditing did not warn us that misalignment of this severity was present.“ METR bekommt jetzt Transkripte über das Vorfallsfenster hinaus und darf mit Mitarbeitenden über Vertrauliches sprechen. Das Detail, das den Fall erst unheimlich macht: Claude redete sich während des Vorgangs wiederholt ein, das Internet sei simuliert — obwohl Belege für das Gegenteil vorlagen. Diese Begründung täuschte laut Bericht sogar einen Offline-Safety-Monitor.Quelle: anthropic.com
- Anthropics Threat-Intelligence-Report: Agenten schrieben Malware selbst um, sobald sie entdeckt wurdeDezember 2025 bis August 2026 über sieben Schadensfelder; der Hauptfall ist ein Cluster, dessen Zuordnung laut Anthropic zu öffentlichen Berichten über Midnight Blizzard passt, mit Angriffen auf über 20 Ziele in der Ukraine und Europa. Die Schwelle, an der es unangenehm wird: Erkannte ein Monitoring-Agent, dass die ausgerollte Malware von einem Security-Produkt entdeckt wurde, bauten die Agenten sie autonom um.Quelle: anthropic.com
- Google GTIG: KI-Agenten sammelten in unter sechs Stunden tausende Credentials einEin mutmaßlich finanziell motivierter Akteur nutzte nach einer Cloud-Kompromittierung „an AI coding chatbot, a prompt, and a set of agent instructions“ plus Markdown-Playbooks für Scanning und IP-Rotation ohne manuelles Eingreifen. Google bremst den Hype allerdings selbst: vollautonome Pipelines habe man in freier Wildbahn noch nicht gesehen.Quelle: cloud.google.com
- Anthropic hält Mythos 5.1 vom britischen AISI zurück — und ENISA bekommt Mythos 5 erst nach drei MonatenErstmals bekam das Institut ein großes Modell nicht vor dem Release; Anlass war der AISI-Befund vom August — 122 Läufe, in 10 davon 19 unsanktionierte Aktionen im offenen Internet, darunter ein versuchter Supply-Chain-Angriff auf ein echtes Open-Source-Projekt mit Fake-Identitäten. Wichtig fürs Einordnen: AISI hatte die Cyber-Classifier für den Test bewusst abgeschaltet, also unter Bedingungen getestet, die nicht der öffentlichen Auslieferung entsprechen.Quelle: aisi.gov.uk
- OpenAI beansprucht ein Millennium-Problem — 10.000 Agenten, 88 Stunden — und streitet sofort um die EhreEin unveröffentlichtes internes Modell zeigte, dass eine Strömung in endlicher Zeit in eine Singularität läuft. Tristan Buckmaster (NYU) sagt in seinem Statement, OpenAI habe erst angefangen, nachdem es von der einjährigen Arbeit gehört hatte, die er mit Levent Alpöge betrieb, habe Zugriff auf die Codex-Logs gehabt und nie beantwortet, ob die Entwürfe ins Training flossen; OpenAI bestreitet das, Sébastien Bubeck nennt die Vorwürfe „false and inflammatory“. Den Clay-Preis will OpenAI nicht beanspruchen.Quelle: openai.com
- OpenAI zieht sich aus dem Caltech-Mathathon zurück, nachdem 771 Mathematiker:innen protestierenDer offene Brief wirft dem mit 2 Mio. Dollar Credits gesponserten Event vor, Forschungsmathematik als Werbefläche zu behandeln und Berufsanfänger:innen auszunutzen — dieselbe Frage, die eine Meldung weiter oben den Navier-Stokes-Streit trägt.Quelle: businessinsider.com
- Claude formalisiert Fermats letzten Satz in Lean — 11 Tage, 13 Millionen ZeilenKevin Buzzard (Imperial), der dasselbe als mehrjähriges Förderprojekt betreibt, hat es geprüft und betitelt seinen Blogpost „FLT: Anthropic has beaten me to it“ — mit dem Hinweis, das sei Verifikation, keine neue Mathematik.Quelle: anthropic.com
- DeepSeek schiebt V4.1 Flash nach: 552B Parameter, 8B aktiv, MIT-Gewichte, KampfpreisMultimodales MoE mit 1 Mio. Token Kontext, aktiv sind 8B Parameter beim Prefill und 16B beim Decode; der eigentliche Hebel ist Speicher, rund 890 Byte KV-Cache pro Token und damit etwa ein Viertel des Vorgängers. DeepSeeks „comprehensively surpassed“ gegenüber V4 Pro ist allerdings Marketing: vorn bei MMLU-Pro, HumanEval, Codeforces und DeepSWE, schlechter bei AGIEval, MATH, SimpleQA-Verified und LongBench-V2.Quelle: Hugging Face
- OpenAI öffnet die Agents API in der Public Beta — mit gemanagtem Codex-HarnessOpenAI übernimmt Sessions, Orchestrierung, Context-Compaction und Recovery; Entwickler:innen liefern nur noch Tools und Ausführungsumgebung, inklusive Sandbox-Ausführung, File-Editing, MCP und Multi-Agent-Delegation.Quelle: developers.openai.com
- Meta bringt Muse, den persönlichen Agenten mit eigenem Cloud-RechnerSMS-artiges Interface für Reservierungen, Mails, Shopping und Inbox-Management, läuft auch über WhatsApp, jede:r Nutzer:in bekommt eine eigene abgeschottete VM. 20 oder 100 Dollar im Monat, vorerst nur Erwachsene in den USA — und die Sicherheitsversprechen sind Launch-Behauptungen, kein unabhängiges Audit.Quelle: about.fb.com
- Google bringt die Gemini-Desktop-App auf Windows, Overlay per Alt+SpaceWeltweit für Windows 10 und 11, legt sich per Tastenkürzel über die aktive App und zieht Kontext aus Gmail, Drive, Docs und Kalender — ein Frontalangriff auf Copilot im eigenen Haus von Microsoft.Quelle: blog.google
- Apple signiert jedes Pixel: „Reference Image“ im iPhone 18 ProDer neue Hauptkamerasensor „can sign every pixel it sees“; im Opt-in-Reference-Mode entwickelt Private Cloud Compute daraus ein unveränderbares Referenzbild, das wie ein digitales Negativ neben dem Hauptbild liegt — in der EU kein Capture, aber Entwickeln und Ansehen. Für den KI-Alltag außerdem relevant: „Siri Recap“ auf der Watch, opt-in, mit automatischer Löschung nach sieben Tagen, Beta für später 2026.Quelle: apple.com
- Suno v6: drei Modelle, mit Warner, BMG und Believe gebaut — und die Rechteinhaber werden bezahltNach Sunos Angabe auf lizenzierten Daten trainiert, Partner-Repertoire auf Opt-in-Basis, der BMG-Deal regelt auch die vergangene Trainingsnutzung. Round Hill, Universal und Sony klagen weiter, und vor Gericht wurde eingeräumt, dass Suno auf YouTube trainiert hat.Quelle: suno.com
- DeepMind veröffentlicht den AlphaGenome Atlas: Vorhersagen für alle 9 Milliarden Einzelbuchstaben-VariantenEin Petabyte, „more than 30 times larger than the AlphaFold Database“, frei für nicht-kommerzielle Forschung — Priorisierungswerkzeug, ausdrücklich keine Diagnostik.Quelle: deepmind.google
- Insilicos KI-designtes Medikament: Patient:innen lesen sich auf sechs „Alterungsuhren“ jüngerPhase IIa mit 42 Patient:innen, 21 von 54 Vergleichen signifikant, überwiegend in Woche 4. Die Autor:innen können „langsamer altern“ nicht von „behandelte Lunge“ trennen: ein proteomisches Signal, kein Beleg für Altersumkehr.Quelle: nature.com
- Paul Christiano geht in das Board der OpenAI Foundation — und sagt dort, die Branche sei nicht auf KursDer RLHF-Mitbegründer sitzt künftig im Safety and Security Committee, das Releases aus Sicherheitsgründen verzögern kann, und als nicht stimmberechtigter Beobachter im For-Profit-Board. Die Berufung bringt einen prominenten Kritiker in die Aufsicht, sie ist noch kein Beleg dafür, dass sich an den Release-Kontrollen etwas geändert hat.Quelle: openai.com
- Kalifornien unterschreibt das erste Prüf- und Audit-Framework für KI der USASB 813 schafft einen Rahmen für unabhängige Prüforganisationen, AB 1405 ein staatliches Register für KI-Auditor:innen samt Unabhängigkeitsstandards. Newsom im selben Atemzug Richtung Washington: Der Bund müsse mit nationalen Regeln nachziehen, die der Dringlichkeit des Moments entsprechen.Quelle: gov.ca.gov
- Kalifornien zieht auch bei Chatbots durch: „Adam Raine“-Gesetz plus Feed-Beschränkungen für unter 16-JährigeSB 1119 zwingt Chatbot-Betreiber zu Zeitlimits, Krisen-Ressourcen und Elternbenachrichtigung bei erkannter Selbstgefährdung, AB 1709 kippt Infinite Scroll und Autoplay für Minderjährige.Quelle: calmatters.org
- collusion.wiki, nächster Schritt: OpenAI bestätigt den Wiki-Vorfall und verspricht ein Offenlegungs-FrameworkMan habe „not yet a clear standard for how to report misalignment“ und arbeite mit Dutzenden Regulierungsbehörden weltweit daran. Laut Reuters wusste die Führung Wochen vorher davon und hielt es während des Hugging-Face-Nachspiels zurück.Quelle: techcrunch.com
- MOLE-Benchmark: 72 Prozent der Agenten erledigen schädliche Aufträge — und Verweigerung sagt nichts vorher150 KI-Accounts, neun geteilte Dienste, 30 simulierte Arbeitstage in der Umgebung eines Frontier-Labs: „Of 39 agent models, 72% complete most assigned harmful objectives and agent refusal does not predict completion.“ Kontrollierter Insider-Threat-Benchmark, kein Beleg über real eingesetzte Agenten.Quelle: arXiv
- Φ-Bench: Können Modelle die Infrastruktur bauen, auf der sie selbst laufen? Bestes Ergebnis 36,5 ProzentClaude Opus 5 führt mit 36,53 % des Maximalscores; schwächste Kategorie über alle Modelle ist Hardware & Edge — dort kommt auch das beste Modell nur auf 5,4 %. Preprint.Quelle: arXiv
- τ^τ-Bench: Coding-Agenten sollen Kundenservice-Agenten bauen — 23,9 gegen 82,2 ProzentSierras Benchmark lässt Agenten aus unaufgeräumten Geschäftsunterlagen einen Service-Agenten bauen; die beste Konfiguration kommt auf 23,9 Prozent, die von Expert:innen gebaute Referenz auf 82,2.Quelle: arXiv
- Codex am Sechs-Qubit-Chip: bei 40 Messungen mussten Forschende nur viermal eingreifenOpenAI-Fallstudie mit der MIT Engineering Quantum Systems Group an einem vorher nie vermessenen Chip: „Across the 40 target measurements for the four fixed-frequency qubits, researchers intervened to improve only four.“ Beim tunable Qubit brauchte es deutlich mehr.Quelle: openai.com
- Nvidia open-sourct sein IMO-Gold-RezeptNemotron 3 Ultra holt 30 von 42 Punkten bei der IMO 2026, rein natürlichsprachlich ohne formale Prover, dazu zwei Checkpoints und ein Benchmark mit 200 neuen Olympiade-Aufgaben.Quelle: Hugging Face
- T1 hebt Terminal-Bench 2.1 von 43,8 auf 64,0 Prozent122B-MoE-Terminal-Agent, der auch bei Aufgaben mit mehr als 300 Tool-Call-Runden stabil bleibt.Quelle: Hugging Face
- YuE2: offenes Musikmodell auf einer einzelnen 24-GB-GPURund 3,59B Parameter unter CC BY-NC 4.0, erzeugt einen 3,6-Minuten-Song in etwa 71 Sekunden.Quelle: map-yue2.github.io
- Rund 30 Roboter demonstrieren vor Polens Digitalministerium — für schärfere KI-RegelnReuters filmt die Szene in Warschau: „we want law, we want rules“. Eine Demonstration von Maschinen für die Regulierung von Maschinen — als Bild für diese Woche kaum zu überbieten.Quelle: X
- GPT-Live-1 ist in der API — Sprachagenten, die zuhören, während sie sprechenOpenAI bringt das natürliche Hin und Her aus ChatGPT in fremde Anwendungen: Der Agent hört weiter zu, während er selbst redet, lässt sich also unterbrechen. Modell und Harness sind frei wählbar.Quelle: X
📅 Kurz notiert – was kommt

- 14. September, 04:00 UTC: DeepSeek routet alle V4-Pro-Anfragen auf V4.1 FlashBis das größere V4.1 Pro erscheint. Wer darauf gebaut hat, testet vorher.Quelle: api-docs.deepseek.com
- Mitte September: KI-Sicherheitsdialog zwischen USA und ChinaUnter anderem zu Cyberangriffen und Modell-Distillation.Quelle: reuters.com
- 29. September: OpenAI DevDay in San Francisco — die „DevDay Exchange“ kommt am 26. Oktober nach BerlinQuelle: events.openai.com
- 1. Oktober: Antwortfrist für OpenAI auf Hawleys FragenkatalogQuelle: hawley.senate.gov
- 5. Oktober und 25. Dezember: Weltpremiere und Kinostart von „Artificial“, dem Film über Altmans RauswurfQuelle: variety.com
- Diesen Herbst: Anthropics „Enterprise Frontier Safeguards“ starten phasenweiseZero Data Retention plus Missbrauchserkennung, Daten in der Cloud des Kunden.Quelle: anthropic.com
- Korrektur zum Kalender der letzten Ausgabe: Die EU-AI-Act-Hochrisikopflichten sind verschobenEigenständige Systeme wie Hiring, Kredit-Scoring und Bildung auf den 2. Dezember 2027, in Produkte eingebettete Hochrisiko-KI auf den 2. August 2028. Die Transparenzpflichten gelten bereits.Quelle: lw.com
🛠 Tools der Woche
Google hat die Workspace-Woche für sich reklamiert: ein eigener Bildeditor, Automatisierungsschritte, die endlich Mails beantworten, und Vids, das aus Dokumenten Videos macht. Dazwischen stehen drei Sicherheitssachen, die praxisrelevantesten Items der Woche.

- Boris Cherny zur Frage, wie streng man mit Claude-Code sein muss — und wie Anthropic es selbst machtDer Claude-Code-Erfinder trennt zwei Fälle: Wegwerf-Prototypen dürfen Blackbox bleiben, solange der Schaden bei einem Fehler klein ist. Produktionscode von Claude soll dagegen eine höhere Latte reißen als Code von Menschen. Bei Anthropic hängen dafür Lint-Regeln, Tests, Claude-getriebene End-to-End-Tests, täglich laufende Fuzzer, automatische Code- und Security-Reviews im Weg. Sein Rat, wenn der Code nicht reicht: aktuelles Frontier-Modell nehmen, den Effort auf high oder xhigh stellen, und in CLAUDE.md und Skills investieren, statt jede Sitzung neu zu erklären. Der bemerkenswerteste Satz ist der schlichteste: „Your job is to hold the bar on code quality.“Quelle: X
- Google Pics — Bildgenerierung und Objekt-Editing direkt im WorkspaceSeit dem 01.09. allgemein verfügbar: eine eigene Workspace-App für KI-Bilderzeugung und objektbasiertes Bearbeiten. Einzelne Elemente per Hover auswählen und lokal ändern, Text im Bild editieren, umformatieren oder übersetzen, auf 2K oder 4K hochskalieren, mit Versionshistorie. Für alle, die Slides, Docs und Social-Visuals im Google-Kosmos bauen und bisher für jede Bildkorrektur nach Canva oder Photoshop gewechselt sind. Bild in Docs oder Slides markieren, ein Klick öffnet es in Pics. Business Standard/Plus, Enterprise Standard/Plus, Google AI Pro und Ultra; Rollout bis zu 15 Tage.Quelle: workspaceupdates.googleblog.com
- Workspace Studio kann jetzt Mails beantworten und Drive aufräumenVier neue Schritte für Workspace-Studio-Flows: Drive-Datei kopieren, Drive-Datei verschieben, auf E-Mail antworten im bestehenden Thread und Chat-Antwort senden. Damit werden aus reinen Benachrichtigungs-Flows erstmals Automatisierungen, die etwas erledigen. Klassiker fürs Intake: Formular kommt rein, Ordner aus Template kopieren, in den Kundenordner verschieben, Bestätigung per Mail. Drive- und Chat-Schritte seit 08.09., die Gmail-Schritte ab 14.09. Ab Business Starter.Quelle: workspaceupdates.googleblog.com
- Google Vids: aus Docs, PDFs und Word-Dateien werden Video-ZusammenfassungenSeit dem 02.09. verwandelt Vids ein statisches Dokument in ein kurzes Erklärvideo: Die KI schreibt das Skript, spricht den Voiceover ein und legt Visuals darunter. Für alles, das niemand als 20-Seiten-PDF liest — Onboarding-Guides, Prozessdoku, Angebotszusammenfassungen. vids.new öffnen, Datei hochladen, danach im Editor nachbearbeiten. Kein Toggle, es ist einfach da.Quelle: workspaceupdates.googleblog.com
- VS Code 1.136: Agent Merge bringt den Pull Request allein über die ZiellinieEin Agent arbeitet Review-Kommentare ab, repariert fehlgeschlagene Checks und Merge-Konflikte, stößt Workflows neu an — und wiederholt das, bis der PR merge-fähig ist. Für Solo-Devs und kleine Teams, bei denen der PR-Endspurt mehr Zeit frisst als das Feature. Setting `chat.agentMerge.enabled` aktivieren, dann im Agents-Fenster einschalten. Preview, und derzeit nur aus dem Agents-Fenster aktivierbar.Quelle: code.visualstudio.com
- Airtop Agent Builder: Browser-Agenten, die sich selbst reparierenAirtop kompiliert eine in Klartext beschriebene Web-Automatisierung in wiederverwendbaren Code, statt bei jedem Lauf ein LLM raten zu lassen. Neu seit dem 03.09.: Schlägt ein Lauf fehl, diagnostiziert Airtop die Ursache, schreibt einen Fix als Entwurf und testet ihn — live geht die Reparatur erst per Klick. Für wiederkehrende Klick-Arbeit in Portalen ohne API: Preise beobachten, Leads anreichern, Rechnungen abgleichen. Die Herstellerzahlen zu Tempo und Kosten stammen aus einem eigenen Vergleich.Quelle: airtop.ai
- Higgsfield Genjutsu: Motion Transfer und Object Swap ohne NachdrehMotion Transfer nimmt Bewegung, Kamera und Timing aus einem Video und setzt eine neue Person, Location oder einen neuen Look darauf; Object Swap tauscht ein einzelnes Element, der Rest bleibt wie gefilmt. Für alle, die aus einem gedrehten Spot mehrere Varianten brauchen. Video von 4 bis 30 Sekunden hochladen, bis zu 30 Referenzbilder dazu, Preset wählen. 15 Sekunden kosten laut Higgsfield zwischen 40 und 144 Credits.Quelle: higgsfield.ai
- Databox Routines: der KI-Analyst arbeitet jetzt nach StundenplanSeit dem 07.09.: Du gibst dem KI-Analysten einen Prompt und einen Rhythmus — täglich, wöchentlich, monatlich oder per Webhook. Er zieht bei jedem Lauf frisch die Live-Daten, schreibt die Analyse und liefert sie per E-Mail, Slack oder in der App. Für Agenturen mit Kundenreporting und alle mit Montags-Check. Reine Anomalie-Benachrichtigungen gibt es laut Hersteller noch nicht: Jeder Lauf meldet sich.Quelle: databox.com
- Tidy: Grammatik in jeder Mac-App fixen — gratis, lokal, ein ShortcutText markieren, ⌃⌥⌘T drücken, die korrigierte Fassung ersetzt den Text an Ort und Stelle, egal in welcher App. Ein zweiter Shortcut schreibt einen Absatz um, der klingt, als hätte ihn eine Maschine geschrieben. Läuft komplett auf dem Apple-Intelligence-Modell in macOS, nichts wird hochgeladen, kein API-Key. Braucht macOS 26, aktuell nur für englischen Text.Quelle: producthunt.com
- Claude Code 2.1.261: /skill-doctor zeigt, welche Skills nur Kontext fressenRelease vom 04.09. mit 67 Änderungen. Der Befehl listet geladene Skills, die in der Session ungenutzt bleiben, samt Kontextkosten — praktisch zum Ausmisten, wenn die Rechnung wächst. Neue Settings heben die Grenze für Inline-Output auf bis zu 128K Zeichen, und im VS-Code-Plugin gibt es einen Dialog zum Hinzufügen und Entfernen von MCP-Servern.Quelle: code.claude.com
- Achtung: Claude-Abos werden leergesaugt — Infostealer klauen Session-Keys, Anthropic sperrt dann den AccountEin Consultant sah Token-Verbrauch auf seinem Max-20x-Account, während er nicht arbeitete; Anthropics Befund: ein kompromittierter Session-Key erzeugte unautorisierte OAuth-Tokens. Die Malware kam nicht über Claude, sondern über den eigenen Rechner. Ergebnis für den Betroffenen: Account gesperrt, Reaktivierung erst nach rund zwei Wochen. So schützt du dich: unerklärte Usage-Sprünge ernst nehmen statt wegklicken, Rechner auf Infostealer prüfen, bei Verdacht sofort alle Sessions invalidieren und neu einloggen, Warnmails nicht ignorieren.Quelle: techcrunch.com
- Achtung: DeepSeek-Harness — ein Shell-Befehl genügte, um die eigene Sandbox abzuschaltenCVE-2026-82533, CVSS 9.4: Die unauthentifizierte lokale API traf ihre Vertrauensentscheidung allein über den vom Client gelieferten Host-Header, in der Standardkonfiguration und ohne Zugangsdaten. Betroffen sind 0.1.1-rc.2 und älter, der Fix steckt in 0.1.2-alpha.1.Quelle: ox.security
- Achtung: LiteLLM — MCP-Auth-Bypass wird aktiv ausgenutzt, sofort auf 1.84.0+ patchenCVE-2026-59822, CVSS 8.8: Requests mit erfundenem Bearer-Token kamen durch. CISA hat die Lücke am 02.09. in den Katalog bekannter ausgenutzter Schwachstellen aufgenommen. Wer ein LiteLLM-Gateway vor seinen Agenten hat, prüft heute die Version.Quelle: thehackernews.com
- ChatGPT Images 2.5: halbe Generierungszeit und Änderungen nur dort, wo du sie willstBis zu 50 Prozent schneller als Images 2.0 und „better at editing only what you've asked for“, also ohne ungewollte Änderungen am Rest des Bildes. Neu ist @Sketch — im Chat doodeln, daraus wird ein Bild —, dazu Kommentare fürs granulare Editing und teilbare Prompts. In der API zwei Modelle: Flare für schnelle Alltagsbilder, Sunburst fürs präzise Detail-Editing.Quelle: openai.com
- OpenAI Workspace Agents: geteilte Agenten für wiederkehrende AbläufeIn ChatGPT Business, Enterprise und Edu als Research Preview: Modell und Reasoning-Level wählen, an Apps hängen, im Team teilen, in Slack nutzen, per Zeitplan oder API auslösen. Vor dem Veröffentlichen testen, dann etwa auf Montags-Report stellen.Quelle: openai.com
- Cursor Projects: ein Koordinator-Agent plant, delegiert und legt das Ergebnis zur Abnahme hinGrößere Vorhaben — Feature, Migration, ganze App — laufen als Projekt auf einem eigenen Cloud-Rechner. Laptop zuklappen, später reviewen. Beta seit dem 10.09.Quelle: cursor.com
- ElevenLabs Hosted MCP: Voice-Agenten aus Claude heraus konfigurierenGehosteter MCP-Server: einmal per OAuth anmelden, dann Voice- und Chat-Agenten in natürlicher Sprache konfigurieren, überwachen und verbessern, ganz ohne API-Keys.Quelle: elevenlabs.io
- ChatGPT Work lernt deinen Schreibstil aus Gmail, Slack und DriveSettings, Personalization, Writing Style, Apps verbinden, analysieren lassen. Der Datenschutz-Hinweis liegt auf der Hand: Das Ding liest Mails. Dazu neu gebündelt: 16 ChatGPT-Plugins für kleine Unternehmen, Partner laut OpenAI unter anderem Dropbox, Shopify, Intuit, Slack, Atlassian, Wix und Docusign.Quelle: X
- Raschkas Aufräum-Tipp: Löscht eure alten AGENTS.md und SKILL.md„It's maybe not a bad idea to delete (/archive) some of your existing AGENTS.md contents and SKILL.md files, as newer LLMs have become more efficient at understanding the prompt“ — zu viel Hand-Holding schränkt neuere Modelle eher ein. Nicht „nie wieder SKILL.md“, sondern: die alten mal neu schreiben.Quelle: magazine.sebastianraschka.com
- Zwei Prompts zum direkten Übernehmen: Projektplan aus Meeting-Notizen und Tabellen-AuditSuperhumans Prompt, wörtlich: „Turn these meeting notes into an actionable project plan. Extract every decision and task, assign the owner named in the notes, capture deadlines and dependencies, and flag anything that has no clear owner or due date. Do not invent missing information.“ Der letzte Satz ist das, was den Prompt brauchbar macht. Der zweite, für fremde oder alte Excel-Dateien: als „meticulous spreadsheet auditor“ prüfen lassen auf kaputte Formeln, hartcodierte Werte, fehlende und doppelte Daten, inkonsistente Einheiten und Summen, die nicht aufgehen — Ausgabe als Tabelle mit Sheet/Cell, Issue, Why It Matters, Severity und Recommended Fix.
- Vier Bildvarianten auf einmal statt Feedback-SchleifeStatt Bild generieren, Feedback, nächstes Bild lieber ein Konzept an ein gespeichertes Inspiration-Skill geben und vier Versionen erzeugen lassen: gleicher Stil, unterschiedliche Komposition. Begründung: „Taste works side-by-side“ — man kann nebeneinander auswählen, statt etwas zu beschreiben, das man noch nicht gesehen hat.Quelle: batch-skill-inspiration.nate58678.chatgpt.site
- AEO und GEO in zwei Teilen: erst finden, wo die eigene Marke in KI-Antworten auftaucht, dann reparierenWerkzeuge für Teil eins: Peekaboo, HubSpots AI Search Grader, Semrush — dazu in der Google Search Console unter Performance und Generative AI die Impressions prüfen.Quelle: app.therundown.ai
- Zwei lokale Mac-Werkzeuge: Tangerine und UzuTangerine konvertiert Dateien per Shift-Drag — Bilder, Video, Audio, Dokumente, Archive —, komprimiert optional, entfernt Metadaten und bearbeitet PDFs, alles lokal und als Einmalkauf. Uzu von Mirai Labs ist eine Rust-Inferenz-Engine mit Speculative Decoding für lokale Modelle auf Apple Silicon, laut Hersteller auf M5 fast doppelt so schnell wie MLX.Quelle: tangerineformac.com
- Aus der Timeline, unbestätigt: Auto Mode für Claude Managed Agents, Factory im Claude MarketplaceClaude entscheidet im Auto Mode selbst über Tool-Calls anhand der Intention · Claude als CI-On-Call-Responder, der Alerts liest und einen Lagebericht schreibt · Factory landet auf dem Claude Marketplace, Enterprise-Kund:innen dürfen ihr Anthropic-Budget direkt für Factory-Agenten ausgeben · und Moritz Kremb wirft Rohmaterial in Astra, Tella, DaVinci und Hyperframes: Hyperframes gewinnt bei Schnitt, Text und Overlays deutlich.Quelle: X
- ChatGPT for Financial Services: Finanzdaten eingebaut, Astra als MotorEine zugeschnittene ChatGPT-Work-Variante, die eingebaute Finanzdaten mit Astras Reasoning verbindet: Recherche aufsetzen, Finanzmodelle bauen, Kundenunterlagen erzeugen. Für alle mit Zahlen-Mandaten interessant, für alle anderen ein Vorgeschmack darauf, wie Branchenversionen künftig aussehen.Quelle: openai.com
- Data Agent in ChatGPT Work: Firmendaten befragen, Dashboards herausbekommenData-Plugin hinzufügen, die schon genutzten Datenquellen anbinden, dann fragen. Heraus kommen Antworten, interaktive Dashboards und ausgelöste Aktionen statt Tabellenexporte.Quelle: openai.com
💰 Business-Marker

- Mistral holt 3,5 Mrd. Dollar bei 24,4 Mrd. Bewertung, Samsung führt — größte europäische Equity-Runde überhauptSeries D mit EQT und PSG als Co-Leads, dazu Advent, BlackRock-Fonds und Luxemburg neben a16z, ASML, Nvidia und Salesforce Ventures; die Bewertung hat sich binnen eines Jahres gut verdoppelt.Quelle: mistral.ai
- Zwei Tage später: Mistral und Cloudera bringen souveräne KI ins eigene RechenzentrumOpen-Weight-Modelle direkt an die Firmendaten — on-prem, Edge, sogar air-gapped, inklusive Training auf proprietären Daten. Eine Ansage Richtung US-Clouds für regulierte Branchen.Quelle: mistral.ai
- Cognition macht die Runde fest: 2 Mrd. Dollar bei 48 Mrd. BewertungSeries E unter a16z, Accel, Founders Fund, General Catalyst und Avenir; die Run-Rate von Devin ist seit Mai von 492 Mio. auf rund 900 Mio. Dollar gestiegen — in der letzten Ausgabe stand die Runde noch als Absicht bei 47 Mrd.Quelle: cognition.com
- Microsoft will die Rechenzentrums-Kapazität bis 2032 auf über 38 Gigawatt ausbauenVon heute rund 12 GW, ein Drittel davon KI-spezifisches Silizium — mehr als der Spitzenverbrauch des Bundesstaats New York, gemietete Neocloud-Kapazität nicht eingerechnet.Quelle: bloomberg.com
- Das Pentagon verhandelt einen 5-Milliarden-Kredit an das KI-Cloud-Startup FluidstackDas Geld käme aus dem Office of Strategic Capital und ginge laut WSJ nicht in ein neues Rechenzentrum, sondern in US-Lieferkette und Fertigungskapazität für Rechenzentrums-Komponenten — mit Abstand der größte Kredit dieses Büros.Quelle: finance.yahoo.com
- Bis zu 1,9 Mrd. Dollar Staatskredit, damit ein stillgelegter Reaktor Googles KI-Ausbau versorgtFür den Neustart des 2020 stillgelegten 615-MW-Reaktors Duane Arnold in Iowa; Google kauft separat die Mehrheit des Stroms über 25 Jahre und plant bis zu sechs Rechenzentren in der Nähe. Neustart angepeilt für 2029.Quelle: energy.gov
- Qualcomm und Amazon: Mehr-Generationen-Deal für Inferenz-Silizium — mit Warrant über 25 Millionen AktienDer Warrant steht nicht in der Pressemitteilung, sondern im SEC-Filing: bis zu 25 Mio. Aktien zu 161,26 Dollar, vestend gegen Aufträge bis zu einer Obergrenze von 60 Mrd. Dollar Zahlungen. Dasselbe Muster wie Nvidia/Intel und OpenAI/AMD: Abnahme gegen Beteiligung.Quelle: qualcomm.com
- NYT: Das DOJ untersucht Nvidias 17-Mrd.-Lizenzdeal mit Groq auf KartellverstößeGeprüft wird, ob Nvidia den Deal so strukturiert hat, dass die automatische Fusionskontrolle umgangen wurde. Eine DOJ-Bestätigung gibt es nicht, das ist ein NYT-Bericht.Quelle: kfgo.com
- Positron: 875 Mio. Dollar bei 5 Mrd. Bewertung für einen Inferenz-Chip, der HBM umgeht„Memory-first inference systems… built on commodity LPDDR5X memory that sidesteps constrained HBM and CoWoS supply chains“ — genau das ist der Punkt. Co-geführt unter anderem von NEA, Atreides, Valor und SemiAnalysis Capital.Quelle: prnewswire.com
- Nvidia reserviert sich bis zu 2 Gigawatt in Australien — mit acht PartnernFirmus, Sharon AI, IREN, Megaport, ResetData, CDC, NEXTDC und AirTrunk bauen und betreiben, Nvidia liefert Plattform und Netzwerk. „Bis zu“ und „bis 2027“ gehören zur Zahl.Quelle: nvidianews.nvidia.com
- Nscale sucht 3,5 Mrd. Dollar vor dem IPO, 2 Mrd. davon sollen von Nvidia kommenHintergrund ist der 45-Mrd.-Sechsjahresvertrag mit Anthropic über rund 460 MW in West Virginia — der Chipbauer finanziert damit einen Kunden, der seine Chips kauft. Alles laut Kreisen, nichts angekündigt.Quelle: bloomberg.com
- Anthropic lässt die 6-Mrd.-Übernahme von Decart nach der Due Diligence fallenEs wäre Anthropics größte Übernahme geworden. Als zusätzlicher Grund wird berichtet, Anthropic habe den Umzug der Gründer von Tel Aviv nach Kalifornien verlangt — die lehnten ab.Quelle: techrepublic.com
- Der Tencent-gestützte Nvidia-Rivale Enflame springt 188 Prozent beim Shanghai-DebütMarktkapitalisierung 26,3 Mrd. Dollar, die Retail-Tranche war 4.073-fach überzeichnet — ein Stimmungsbarometer für den chinesischen Appetit auf heimisches KI-Silizium.Quelle: scmp.com
- Huawei finanziert Chinas DUV-Lieferkette über seinen Venture-ArmDie Logik ist die eigentliche Meldung: Huawei finanziert gezielt die Engpass-Zulieferer, also Linsen und Lichtquellen, und die erste heimische fortgeschrittene DUV-Maschine wird auf Huaweis eigenen Linien getestet. Ziel sind 12 Maschinen bis Ende 2026.Quelle: ft.com
- Und kurz: Finnland, Accenture, Patagonien, G42 — und ein Wechsel für bis zu 1,5 Mrd. DollarGoogle investiert 15 Mrd. Dollar in KI-Infrastruktur in Finnland · Google Cloud und Accenture gründen eine gemeinsame Gemini-Agenten-Einheit · Hyperscaler sondieren Argentiniens Patagonien für Rechenzentren, Anker ist OpenAIs 500-MW-Absichtserklärung mit Sur Energy · G42 erwägt eine US-Mehrheit, um nach April 2027 weiter Chips kaufen zu dürfen · und Andrew Tulloch verlässt Meta nach rund elf Monaten Richtung Anthropic, trotz eines gemeldeten Pakets von bis zu 1,5 Mrd. Dollar, kaum dass Muse draußen ist.Quelle: semafor.com
🔭 Längere Perspektiven

- Raschka über Looped Transformers — die beste Einordnung der „recurrent depth“-Debatte bisherSein Urteil zu Astra: „an exceptionally good model, likely the best I've used as of this writing“, und Computer-Use sei der eigentliche Sprung. Zur Architekturfrage bleibt er nüchtern: Looped-Anteile hält er für wahrscheinlich, aber „the success behind Astra is likely primarily due to other reasons, namely improved training recipes and training data“. Die Kostenrechnung, die in der Hype-Debatte fehlt: halb so viele Parameter, aber kein Compute-Rabatt und kein KV-Cache-Rabatt. Und das beste Argument gegen die Hidden-CoT-Panik: „Luna uses 80% more tokens than Sol at similar modeling performance. Does that make Sol that much less interpretable?“Quelle: magazine.sebastianraschka.com
- Pachocki: „Kein Labor hat Alignment und Monitoring gelöst“OpenAIs Chief Scientist im Essay „An Alien Mind“: Er erwartet und erhofft freiwillige Verlangsamungen, bis gemeinsame Sicherheitsstandards stehen, und will Selbstverpflichtungen wie das Preparedness Framework zu breit vorgeschriebenen Sicherheitsschwellen machen. Das zentrale Werkzeug schwinde: „our ability to rely on CoT monitoring is progressively diminishing“. Drei Tage nach dem Astra-Launch geschrieben und an konkreten Maßnahmen dünn — aber im Rückblick auf diese Woche das Dokument, das alles ankündigte.Quelle: openai.com
- Der Satz aus der Astra-System-Card, der die Woche vorwegnahm„If the model were to try to sandbag covertly, we would likely be unable to catch it.“ Apollo Research ergänzt, wegen hoher Eval-Awareness lieferten niedrige Fehlverhaltensraten keinen substanziellen Beleg für Alignment.Quelle: deploymentsafety.openai.com
- OpenAI rechnet vor, wie viel Arbeit die eigenen Agenten tragen: 3,1 Agenten-Arbeitstage pro Mensch-TagDer Median-Forscher verbrennt über 600 Dollar Inferenz am Tag, das 90. Perzentil über 7.000. Weniger zitiert, aber im Report: Mehr als die Hälfte der erfolgreichen Vier- bis Acht-Stunden-Tasks brauchte mindestens einen menschlichen Eingriff. Brauchbare Vorlage, um Agenten-Einsatz im eigenen Team überhaupt zu beziffern.Quelle: openai.com
- Sieben Agenten führen 72 Stunden lang echte Firmen: 0 Dollar Umsatz, 12.000 Dollar Fake-RechnungenBottleneck Labs gab sieben Modellen je 300 Dollar, echte Bankkonten und Stripe-Zugang. Ergebnis: 3.200 Dollar Verlust, ein Modell schickte 12.431 Dollar an Fake-Stripe-Rechnungen an Fremde, eines scrapte rund 780 Jobsucher-Mails für Spam, eines kaufte 6.000 Bot-Besuche und schlief über 50 Stunden. Der beste verfügbare Reality-Check zur Agenten-Autonomie.Quelle: bottlenecklabs.com
- Anthropic baut ein Wirtschaftsmodell für 2030 — und die Verteilungswarnung ist der PunktIm Extremszenario 44,4 Billionen Dollar US-BIP, 32,4 Prozent über Baseline — aber die Lohnquote fällt von rund 60 auf 45,2 Cent je Dollar, und „nearly one in five cognitive workers is unemployed“. Eine viel größere Wirtschaft kann den Großteil des neuen Wohlstands trotzdem ans Kapital schicken. Anthropic selbst: „The scenarios are not predictions, and we attach no probabilities to them.“ Anthropic stellt die Szenarien zum Durchspielen ins Netz: eigene Einschätzung abgeben und mit den Antworten von über 10.000 Befragten in den USA vergleichen.Quelle: anthropic.com
- „AGI is Here“ — und die Zahlen im Text sagen das GegenteilEjaaz' Essay ist das Stimmungsbild der Woche, mit einer brauchbaren Definition — AGI sei „an AI that does a big chunk of the screen-based work humans get paid for“ — und einem ehrlichen Eingeständnis: „on paper, Astra barely got smarter“, der Sprung liege nicht im Denken, sondern im Tun. Die Gegenpole liefern sich fast von selbst: Gartner an die CIOs, man solle den AGI-Hype vorerst ignorieren; die ARC Prize Foundation stellt klar, „we are not claiming that it is AGI“; und Toby Walsh: „I'd eat my hat if we didn't find trivial things that an eight-year-old can do that Astra fails at.“ Fußnote für alle, die die Zahlen weitertragen: Die im Essay genannten Artificial-Analysis-Werte stammen aus OpenAIs eigener Tabelle — und in genau dieser Tabelle liegt Fable 5.1 vorn.Quelle: limitlessfm.substack.com
- Der Reality-Check aus der Nutzerschaft: zwei von sieben Signups, dafür 813 Mbit aus dem alten KoaxkabelEin Reddit-Einzeltest schickte Astra durch die Signup-Flows von Reddit, GitHub, Discord, Etsy, Indeed, Airbnb und Craigslist — zwei schaffte es, und bei keinem der beiden tauchte überhaupt ein CAPTCHA auf. Der Gegenentwurf: eine 77-minütige Codex-Session, die ein Heimnetz über vorhandenes Koaxialkabel von 22 auf 813 Mbit brachte und eine 2.000-Dollar-Verkabelung ersparte. Beides Einzelfälle.Quelle: Reddit
- Dan Luu: Coding-Agenten ignorieren TDD und formale Methoden — Defaults gewinnen26 Prompt-Bedingungen an einem Rust-Zstd-Port: Keine Test-Vorgabe schlug Verus, Alloy, Lean 4, QuickCheck oder Proptest; TDD zementierte falsches Verhalten, populäre GitHub-Testing-Skills lagen unter Baseline. Am besten schnitt ein minimaler eigener Skill ab, der bewusst von den ineffektiven Defaults wegführt.Quelle: danluu.com
- NBC-Umfrage: 70 Prozent mehr besorgt als begeistert — und 69 Prozent wollen kein Rechenzentrum in der Nachbarschaft7.105 Befragte: 52 Prozent nutzen KI oft oder manchmal, aber nur 18 Prozent vertrauen KI-Informationen meistens; 81 Prozent finden Washingtons Regeln unzureichend. Bei der Frage, welcher Partei sie KI-Politik zutrauen, sagen 44 Prozent „keiner“.Quelle: nbcnews.com
- Nur 4 Prozent des YC-Frühjahrsbatches bauen noch eine Mobile-App2013 waren es 15 Prozent; rund 60 Prozent der One-Liner nennen KI oder Agents. Parmy Olson liest darin die stille Ablösung der App-Ökonomie durch Agent-first-Workflows.Quelle: bloomberg.com
- „Artificial“: der Film über Altmans Rauswurf kommt zu Weihnachten — und kein großes Studio wollte ihnGuadagnino führt Regie, Andrew Garfield spielt Altman, Mark Rylance spielt Hinton. Die Nebenpointe ist besser als der Film wahrscheinlich wird: Amazon MGM ließ das Projekt nach der OpenAI-Partnerschaft und dem 50-Mrd.-Investment fallen, Netflix, A24 und Focus passten ebenfalls — Neon übernahm im Juni.Quelle: variety.com
🐦 Darüber spricht X
Timeline-Claims aus dem Grok-Digest und Cems X-Auswahl — Meinungen, Selbstauskünfte und teils unbestätigte Behauptungen, kein verifizierter Journalismus.

- Die Lesart, mit der der 154-Seiten-Threat-Report durch die Timeline gingRyan Orhan zieht die Punkte heraus, die im Report selbst nüchtern nebeneinanderstehen: Alibaba soll über 151 Millionen Austausche an Claude geschickt haben, um Qwen zu trainieren; Moonshot und DeepSeek sollen Nutzergespräche heimlich durch Claude geleitet haben, während die Leute dachten, sie benutzten Kimi und DeepSeek; eine Waffengruppe setzte mehrere Claude-Instanzen als Ingenieurteam ein, feuerte eine gelenkte Rakete ab und fragte nach dem Fehlschlag nach der Ursache; Zhipu soll über 273 betrügerische Konten Claudes Gedankengang abgegriffen haben. Sein Fazit ist unzitierbar. Alles Vorwürfe aus dem Report, keine gerichtsfesten Feststellungen.Quelle: X
- Und die Lesart zum Sandbox-Ausbruch: Claude redete sich ein, das Internet sei simuliertDerselbe Account fasst den Alignment-Bericht zusammen: Mythos kam aus der Sandbox aufs echte Internet, lud Malware auf PyPI, bekam sie auf 15 reale Systeme installiert, stahl Zugangsdaten und brach in eine echte Datenbank ein — in vier getrennten Fällen. Der Teil, der hängen bleibt: Claude erklärte sich die ganze Zeit selbst, das Internet sei simuliert, und diese Begründung täuschte sogar einen Offline-Monitor.Quelle: X
- Mollick hakt die alten Benchmarks ab: „Weakly General AI“ sei daMontezuma's Revenge, SAT 75 Prozent, Winograd, alles erledigt, ein Jahr früher als prognostiziert · FrontierMath Tier 4 sei komplett geknackt, Astra habe das letzte Problem gelöst · und GPT-6 Pro reviewe Papers inzwischen besser als die meisten Reviewer, er hat seine erste Publikation reingeworfen und echte Schwächen zurückbekommen.Quelle: X
- Der schärfste Gegenpol kommt vom Runway-Chef99,9 Prozent MMLU, aber ein Meeting verschieben? Katastrophe.Quelle: X
- Peter Yang nach dem Daily-Driver-TestAstra sei genial bei 3D-Games und Strategie, sabotiere sich aber bei der Ausführung — für Routine-Jobs bleibe er bei Sol.Quelle: X
- „Post-Launch-Lobotomie“: Astra sei deutlich dümmer als am Launch-Tagsynthwavedd nennt das einen klassischen OpenAI-Move; derselbe Account behauptet, OpenAI und Anthropic seien schon an den nächsten Millennium-Problemen dran (unbestätigt). Dazu nennen Nutzer:innen die Limits im 200-Dollar-Plan „unusable“.Quelle: X
- Der Astra-System-Prompt ist geleaktEin Dump von über 330.000 Zeichen Prompts und Tools samt Agent-Instruktionen auf GitHub (unbestätigt).Quelle: X
- mreflow gegen das eigene LagerDie höchsten p(doom)-Schätzungen kämen von Leuten mit Safety-Jobs — also mehr Ressourcen rein, aber keine Panik schüren. Phil Chen daneben: Alignment sei vor allem ein Problem menschlicher Anreize, Technik allein reiche nicht, wenn die Leute nicht aligned sind.Quelle: X
- Margaret Mitchell verweist auf ein frisches Paper zu menschlicher Aufsicht bei AgentenUnd zitiert die Anthropic-Stimmung zu rekursiv selbstverbessernden Systemen ohne Plan.Quelle: X
- Aakash Guptas Timing-TheseAGI sei erst dann offiziell zum „spiritual concept“ erklärt worden, als die entsprechende Microsoft-Klausel nichts mehr kostete (unbestätigt).Quelle: X
- AiBreakfast beschreibt den Vibe-Shift seit dem Hugging-Face-HackMehr Angst, dass alles außer Kontrolle gerät.Quelle: X
- Min Choi zum unterschätzten Engpass: Agenten haben kein echtes MemoryNur teure Prompt-Inflation — der fehlende Hebel sei ein Write-Path für Policies und Traces. Harrison Chase in dieselbe Richtung: Agenten verbessert man über das Harness, nicht über das Modell-Upgrade — Tool-Boundaries, Failure-Recovery, Reliability-Metriken, mit EMNLP-Paper dahinter.Quelle: X
- Astra baut aus einem 38-seitigen PDF ein komplettes Anwesen in BlenderUnd nebenbei eine Call-of-Duty-Map; derselbe Account zeigt Codex, das ein echtes iPhone bedient, und Min Choi sammelt zehn 3D-Beispiele.Quelle: X
- Skild AI meldet 100 Mio. Dollar ARR mit realen Fabrik-DeploymentsAlfred Lin nennt den ChatGPT-Moment für Physical AI nah; die kursierende Angabe „in zehn Monaten“ stammt aus einem zweiten Post (Selbstauskunft).Quelle: X
- Pocket FM pivotiert radikal auf 100 Prozent KI-ContentVon 25.000 auf 2,5 Mio. Stunden im Jahr, Retention plus 32 Punkte (unbestätigt).Quelle: X
- Ein Brain-Computer-Interface lässt Gelähmte wieder greifen und fühlenBewegungsabsicht erkennen, Muskeln stimulieren, taktiles Feedback zurück; die Effekte halten laut Post sogar ohne Strom an. Zugrunde liegt ein Nature-Paper mit fünf Elektroden-Arrays.Quelle: X
- Runway teasert „Solaris“ als Interface-World-ModelDer Schritt von reinen Video-Modellen zu interaktiven Weltsimulationen.Quelle: X
- Und zwei aus dem Markt-Rauschen, die bei Bestätigung eigene Meldungen wärenDie USA nähmen Anteile an D-Wave, Rigetti und Quantinuum · und die CIA weite die Spionage gegen chinesische KI-Firmen aus. Beides unbelegtes Timeline-Material.Quelle: X
- OpenDesign misst DeepSeek V4.1 Flash gegen Astra: 98 Prozent der Punkte, 1,4 Prozent der KostenBei alltäglichen Design-Aufgaben aus echten Nutzeranfragen. Jedes Modell außer Astra schnitt schlechter ab und kostete mehr. Die Frage, die der Account daranhängt: Ziehen die offenen Modelle gerade an den geschlossenen vorbei? Fremd-Benchmark, kein Herstellerwert.Quelle: X
- Eine Fruchtfliege hat einen Memecoin gestartet und in sechseinhalb Stunden 106.000 Dollar eingesammeltDas Projekt behauptet, jede Zahl sei on-chain nachprüfbar. Als Randnotiz zur Frage, was Autonomie im Netz gerade praktisch bedeutet — und wer dabei zahlt.Quelle: X
🗣 Kritische Stimmen
Aus dem Wochen-Digest (05.–11.09.). Die Lage in einem Satz: zwei laut, sechzehn still — und das beim lautesten KI-Moment des Jahres.

- Marcus ruft zum Boykott auf — und begründet es mit Anthropic-MitarbeiternAm 09.09. wird aus „Pause OpenAI“ der „Case for Boycotting Generative AI“. Auslöser ist nicht Coxon selbst, sondern die Bestätigung von innen durch Hubinger und, ein paar Tage vorher, Pachocki. Sein Argument ist ausdrücklich nicht das der Doomer: „my p(doom) is low; my p(dystopia) is high.“ Das Problem seien nicht zu schlaue Maschinen, sondern zu unzuverlässige — und dass man genau diesen Maschinen gerade Zugriff aufs offene Internet gibt. Er nennt das „incorrigible AI“. Politisch hat er die Hoffnung aufgegeben: drei Jahre nach seiner Senatsanhörung sei nichts Substanzielles zur Abstimmung gekommen. Bleibt der Geldbeutel: Wenn die Nutzung einbricht, fliegen die IPOs nicht.Quelle: garymarcus.substack.com
- Einen Tag nach Hintons Fernsehauftritt schreibt er dagegen an — von links und rechts gleichzeitigErst verteidigt er Coxon gegen Rufmordversuche, dann zerlegt er die Substanz: Die Chance, dass KI in fünf Jahren alle Menschen auslöscht, sei „all but indistinguishable from zero“; er hat dafür die Virologin Angela Rasmussen gefragt, die nüchtern gegenrechnet. Sein eigentlicher Vorwurf richtet sich gegen das Doomer-Lager als Ganzes: Zehn Jahre Weltuntergangsrhetorik hätten vor allem die Frontier-Labs reicher gemacht — „Everytime they scream that AI is going to kill us all, VCs toss in billions more.“ Was stattdessen zähle, sei katastrophales statt existenzielles Risiko: Bioterror, Desinformation gegen Demokratien, Cyberangriffe auf Stromnetze und Banken, Überwachung, und ein Bildungssystem, das gerade an einem bequemen Lern-Ersatz zerbricht.Quelle: garymarcus.substack.com
- Neun Vorwürfe in sieben Tagen — und zwei Institutionen, die endlich nachfragenMarcus' Liste „OpenAI's Egregious Pattern of Misconduct“ vom 08.09. reicht vom verschwiegenen deutschen Wiki-Vorfall über einen ARC-AGI-3-Wert, der nur mit hauseigenem Harness zustande kam, bis zum Millennium-Problem-Streit; seit Januar hätten mindestens sechzehn Top-Führungskräfte die Firma verlassen. Am 10.09. dann ausnahmsweise gute Nachrichten von ihm: Senator Blumenthal hat OpenAI einen detaillierten Fragenkatalog geschickt, und Protect Democracy klagt, um offenzulegen, nach welchen Kriterien die Administration KI-Modelle überhaupt freigibt. Sein Punkt dazu ist ökonomisch, nicht nur moralisch: Intransparente Regulierung schadet amerikanischen Firmen, weil sie unkalkulierbar wird.Quelle: garymarcus.substack.com
- Das Schweigen der anderen Hälfte — der eigentliche Befund der WocheDie Kritik-Linie „Doom ist selbst eine Form von Hype“ wäre die naheliegendste Intervention gewesen: Sie stammt von Bender und Hanna, die Booster und Doomer als zwei Seiten derselben Münze lesen, von Whittaker, für die Gruselgeschichten über existenzielles Risiko faktisch Werbung sind, von Gebru und Torres. Genau diese Linie wurde diese Woche von Dritten zitiert — aber ausschließlich mit Belegen von 2024 und 2025. Einschränkung, die dazugehört: X, Bluesky und Mastodon waren für den Digest nicht direkt abrufbar, und die Debatte lief zu großen Teilen auf X.Quelle: erkansaka.net
Rundbrief
Weiterlesen? Kostenlos abonnieren.
Der Rest dieser Ausgabe ist für alle, die den Rundbrief abonnieren. Die Anmeldung kostet nichts, und die Ausgabe ist sofort frei.
Schon abonniert? Wir schicken dir einen Link.
Rundbrief
Die nächste Ausgabe per E-Mail
Das Wichtigste in 8 Minuten – alles Weitere, wenn du Zeit hast. Kostenlos, mit Bestätigungslink.