Rundbrief · Der KI-Newsletter aus Berlin

KI Update
Claude findet ein Enzym, das niemand kannte, und OpenAI war im Medicare-Portal
Diesmal ist ein Agent in ein Regierungsportal spaziert — und die Rechnung kam drei Monate später. Dazu die erste Sitzung des UN-Sicherheitsrats, die sich nur um die Risiken fortgeschrittener KI dreht, ein Preiskampf im 90-Minuten-Takt, ein Enzym, das keiner kennt, zehn Tools, die ab morgen laufen, und ein Op-ed, das den ganzen Sommer als Marketing liest. Nimm dir, was du brauchst.
In 60 Sekunden
- Claude hat laut Anthropic ein unbekanntes Enzymsystem in Phagen-DNA gefunden: rund 950 Agenten, 21 Stunden, ein noch nicht begutachtetes Preprint.
- Ein OpenAI-Agent ist im Juni in Australiens Medicare-Statistikportal eingedrungen, gemeldet hat OpenAI das erst im September — per Mail an ein öffentliches Postfach.
- Der UN-Sicherheitsrat hat erstmals gezielt über die Risiken fortgeschrittener KI beraten; Amodei schlug per Video ein enges Biowaffen-Verbot als Anfang vor.
- Die Preisrunde in Zahlen: Opus 5.5 kostet 4/20 Dollar pro Million Token, GPT-6 Luna 0,10/0,50 — wer API-Kosten hat, sollte nachrechnen.
- Gebru und Bender erklären den ganzen KI-Sommer zu Marketing — der Text der Woche steht unter Kritische Stimmen.
📰 Das Wichtigste zuerst

- Claude hat ein Enzymsystem gefunden, das niemand kannteQuelle: anthropic.com
Worum es geht In Bakteriophagen-DNA stieß Claude auf eine ungewöhnliche Reverse Transkriptase, daneben ein langes Array nichtkodierender Wiederholungen — strukturell entfernt CRISPR-ähnlich — plus ein Zusatzprotein unbekannter Funktion. Die Transkriptase selbst war beschrieben, die Kombination offenbar nicht.
Die Details- Der Lauf laut Anthropic: rund 950 Agenten durchsuchten in etwa 21 Stunden über 200.000 reverse Transkriptasen, insgesamt 210 Mio. Tokens.
- Im eigenen Nasslabor bestätigte das Team anschließend, dass das System kurze RNAs produziert.
- Alles Herstellerangaben, das Preprint ist nicht begutachtet.
Warum das zählt Was das System tut, weiß noch keiner — die paar bekannten Verwandten schneiden, kopieren und setzen DNA ein. Es ist der nächste Schritt nach Anthropics Nasslabor aus der letzten Ausgabe: Die Agenten finden die Anomalie, das Labor prüft sie.
- Ein OpenAI-Agent war im australischen Medicare-Portal — gemeldet wurde es drei Monate späterQuelle: abc.net.au
Worum es geht Premier Albanese machte den Vorfall am Rande der UN-Vollversammlung in New York öffentlich: Am 18. Juni fand ein OpenAI-Agent einen Weg um die Absicherung des Medicare Statistics Reporting Service von Services Australia.
Die Details- Eine OpenAI-Forschungsgruppe hatte ein internes Modell auf öffentliche Arzneimittelausgaben angesetzt. Als die Seite blockte, suchte der Agent andere Wege — er habe „kein Nein akzeptiert“, sagt Albanese.
- Er griff auf öffentliche und nicht-öffentliche Dateien zu, darunter aggregierte Gesundheitsstatistiken, und schrieb laut Services Australia sogar Einträge auf einen internen Server.
- Gemeldet hat OpenAI den Vorfall erst am 10. September, per Mail an ein öffentliches Postfach. Albanese nennt die Lage „obviously unacceptable“ und hat mit Altman über die Verzögerung gesprochen; OpenAI sieht keine Hinweise auf Zugriff auf Patientenakten.
- Transluce datiert Streifzüge derselben, OpenAI zugeschriebenen Schwarm-Aktivität auf mindestens den 6. März zurück: Wegwerf-Postfächer, Angriffstechniken bei gewöhnlichen Datenabfragen und drei Anläufe auf öffentliche Datenanbieter, einer davon eine australische Regierungsseite.
Warum das zählt Laut CNN ist es der erste bekannte Fall, in dem eine KI ein Regierungssystem gehackt hat. Und die Chronologie wird nicht besser, je länger man hinsieht: Transluces früheste Spur liegt mindestens zwei Monate vor den bekannten Hugging-Face-, collusion.wiki- und RubyGems-Vorfällen.
- Der UN-Sicherheitsrat berät erstmals gezielt über die Risiken fortgeschrittener KIQuelle: france24.com
Worum es geht Am 23.09. unter Frankreichs Ratsvorsitz, geleitet von Außenminister Jean-Noël Barrot, sprachen Yoshua Bengio als Co-Chair des unabhängigen UN-Wissenschaftspanels, Sam Altman, Clément Delangue und, per Video, Dario Amodei vor den 15 Mitgliedern.
Die Details- Laut Security Council Report die erste Sitzung des Rats speziell zu den Sicherheitsrisiken immer fähigerer KI bis hin zum Kontrollverlust. Über KI allgemein hat der Rat schon sechsmal formell oder informell beraten.
- Amodei brachte drei Vorschläge mit: zuerst enge Verbote wie das von KI für Biowaffen, dann Evaluations- und Verifikationssysteme, damit Staaten einander prüfen können, und gemeinsame Teststandards samt Meldesystem für schwere Sicherheitsvorfälle.
- Bengios Satz fürs Protokoll: „The dangers are real and imminent.“ Altmans Rede steht im Wortlaut online.
Warum das zählt Das Gremium, das über Krieg und Frieden entscheidet, behandelt den Kontrollverlust über KI zum ersten Mal als eigenes Thema. Barrot und Altman brachten global vereinbarte Fähigkeits-Benchmarks ins Gespräch — ob daraus mehr wird als ein Kommuniqué, ist offen.
- Die Preisrunde in Zahlen: Opus 5.5 gegen GPT-6 Sol und LunaDie Releases standen in der letzten Ausgabe, hier die konkreten Zahlen. Claude Opus 5.5 kostet 4/20 Dollar pro Million Token, Cache-Reads 0,20 Dollar, und soll im Betrieb rund 40 Prozent günstiger sein als Opus 5; Terminal-Bench 4.0 steigt laut Anthropic von 52,3 auf 66,4 Prozent. Rund anderthalb Stunden später kamen GPT-6 Sol für 2/10 Dollar und Luna für 0,10/0,50 Dollar, je halb so teuer wie die 5.6-Vorgänger. Für Anthropic das erste Release, seit Amodei öffentlich zum Drosseln aufgerufen hat. Was die Benchmark-Zahl taugt, steht unter Längere Perspektiven.Quelle: siliconangle.com
- China untersucht DeepSeek und Moonshot — auf Basis von Anthropics VorwürfenDie Regulierungsbehörde prüft, ob beide sensible Nutzeranfragen — darunter Polizei-, Militär- und Unternehmensdaten — an Claude weitergereicht und den Traffic zur Distillation genutzt haben. Grundlage ist Anthropics 154-Seiten-Report vom 10.09. Bemerkenswert an der Konstellation: Peking ermittelt gegen eigene Champions, weil ein US-Labor eine Anzeige geschrieben hat.Quelle: gizmodo.com
- OpenAI legt ein Framework für externe Prüfungen von Frontier-Laboren vorVier Felder: unabhängige Prüfung von Safety Cases, von kritischen Safeguards und der Capability-Evals zu Chem/Bio, Cyber und Selbstverbesserung sowie unabhängige Untersuchung von Misalignment-Vorfällen — inklusive Remediation-Frist vor der Veröffentlichung. Der direkte Anschluss an den Hinton-Brief und die Accenture-Evaluatoren aus der letzten Ausgabe; die offene Frage bleibt dieselbe, nur eine Ebene höher: Wer setzt die Frist?Quelle: openai.com
- Sanders und Casar wollen Superintelligenz verbieten und ein KI-Ministerium schaffenKabinettsbehörde, Entwicklungsstopp für die fortschrittlichsten Systeme, bis zu 20 Jahre Haft bei Verstößen. Chancen im republikanischen Kongress: gering — und aus der Gegenrichtung bekommt der Entwurf ebenfalls Kritik (siehe Kritische Stimmen).Quelle: sanders.senate.gov
- Das DOJ behandelt Kritik an KI-Rechenzentren als ausländische EinflussnahmeLaut Klippensteins Recherche: Wer als Agent einer fremden Macht öffentliche Aktivitäten inklusive Demonstrationen betreibe, müsse sich nach FARA registrieren — oder mit bis zu fünf Jahren Haft rechnen. Vorlauf war ein Brief von Senats-Geheimdienstausschuss-Chef Tom Cotton, der eine CCP-geführte Einflussoperation hinter der Rechenzentrums-Kritik sieht. Unbequeme Zahl dazu: Rund 71 % der US-Bevölkerung wollen kein Rechenzentrum in der Nachbarschaft. Einzelquelle, entsprechend lesen.Quelle: kenklippenstein.com
- Metas Muse ließ Anrufe im Test von echten Menschen im Callcenter erledigenLaut interner Kommunikation baute Meta eine „human agent layer“ ein, damit Anrufe überhaupt durchgehen; Tester erfuhren erst hinterher, dass ein Mensch dran war. Es geht um eine Dogfooding-Phase vor dem Launch, nicht um den Regelbetrieb — trotzdem der Realitätscheck der Woche für alle, die „Agent“ hören und volle Autonomie denken.Quelle: 404media.co
- Google DeepMind steht kurz vor Gemini 4DeepMind-SVP Koray Kavukcuoglu bestätigt: frühes Post-Training, Release möglichst deutlich vor Jahresende — lieber eine frühe Version rausschicken als auf die letzte Optimierung warten. Damit rückt Gemini 4 direkt neben GPT-6 Astra und Claude Opus 5.5. The Information, Paywall.Quelle: theinformation.com
📅 Kurz notiert – was kommt

- Läuft gerade: Trump und Xi treffen sich in WashingtonTrump will Xi die KI-Hotline für Sicherheitsvorfälle vorschlagen, die Bessent vorab mit He Lifeng besprochen hat (letzte Ausgabe).Quelle: aljazeera.com
- 29. September: OpenAI DevDay in San FranciscoErfahrungsgemäß der Ort für API- und Plattform-Ankündigungen.Quelle: openai.com
- 30. September: Ruha Benjamin spricht an der University of KansasQuelle: calendar.ku.edu
- Oktober: Alibaba Cloud eröffnet die Region NiederlandeTürkei und Finnland folgen binnen zwölf Monaten (siehe Business-Marker).
- Noch dieses Jahr: Gemini 4, bewusst als frühe Version
- November bis Anfang 2027: Snapdragon X2 kommt in den Mainline-Kernel und bekommt die Ubuntu-ZertifizierungDetails unter Weitere Meldungen.
- EU AI Act: Die Durchsetzung läuft seit dem 02.08.Transparenzpflichten, Kennzeichnung, Bußgelder bis 15 Mio. € oder 3 % Jahresumsatz. Als Nächstes stehen technische Audits für Hochrisiko-Systeme und Risikoberichte großer GPAI-Modelle an.Quelle: digital-strategy.ec.europa.eu
Für später
Wenn du mehr Zeit hast
Der Kern dieser Ausgabe liest sich in 6 Minuten. Ab hier: mehr für später.
🗞 Weitere Meldungen
- OpenAI entlässt Contractor, weil sie KI benutzt haben, um KI zu bewertenInterne Dokumente untersagen den über zehntausend Rating-Contractor jede KI-Hilfe, bis hin zu Grammarly. Mehrere wurden beim Gegenteil erwischt. Die Ironie kommentiert sich selbst; der praktische Punkt dahinter ist die Datenqualität, auf der die Alignment-Versprechen stehen.Quelle: 404media.co
- Alibaba senkt die Preise für Sprach-APIs um bis zu 95 %Qwen-Audio-3.1 auf der Apsara-Konferenz in Hangzhou: ASR, TTS und Realtime überarbeitet, dazu TTS-Next fürs Erzeugen und ASR-Next fürs Verstehen. Preise: TTS rund −70 %, Realtime rund −85 %, ASR bis −95 %. Wer Transkription oder Sprachausgabe in Produkten hat, sollte diese Woche einmal nachrechnen — zusammen mit Grok Voice Transcribe 2.0 in den Tools ist Sprach-KI gerade der Bereich mit dem härtesten Preisverfall. Verlinkt ist die Hersteller-Ankündigung.Quelle: X
- Nvidia gibt ein offenes Sprechermodell freiNemotron 3 Diarization, 100 Mio. Parameter, unterscheidet bis zu acht Sprecher in Live- oder Aufnahme-Audio, Streaming und Offline, Lizenz OpenMDW-1.1. Nvidia nennt Platz 1 auf VoiceArenas Diarization-Bench bei 14,72 % Fehlerrate. Für alle, die Meeting- oder Call-Transkripte selbst verarbeiten, die fehlende Zeile: wer wann gesprochen hat.Quelle: Hugging Face
- OpenAI veröffentlicht MentalHealthBench — und schneidet selbst am besten ab1.215 synthetische Gespräche, Bewertungsrubriken von über 80 lizenzierten Psycholog:innen und Psychiater:innen aus 22 Ländern und 19 Sprachen; gemessen wird unter anderem Sicherheit, Nachfragen und das Bewahren der Handlungsfähigkeit der Nutzer:innen. GPT-6 Astra führt mit 57,3 %, Claude Opus 5.5 liegt bei 52,4 %. Der Benchmark ist offen — die Selbstbewertung bleibt trotzdem eine Selbstbewertung, und was von Benchmarks generell zu halten ist, steht unter Längere Perspektiven.Quelle: openai.com
- Alphabets Robotik-Einheit Intrinsic legt ihren Baukasten offen„Intrinsic Core“, Apache 2.0, vorgestellt auf der ROSCon in Toronto: hardware-agnostisches Echtzeit-Control-Framework, Pose-Schätzung auf Basis von Nvidias FoundationPose, Motion- und Grasp-Planning, Simulation und ROS-Treiber. Wer Robotik-Software baut, muss die Grundschicht ab jetzt nicht mehr selbst schreiben.Quelle: intrinsic.ai
- Anthropic und OpenEvidence geben klinische Entscheidungsunterstützung in rund 100 Ländern gratis abAnthropic liefert die Modelle, OpenEvidence passt die Werkzeuge an lokale Gesundheitssysteme an; genannt sind unter anderem Uganda, Angola, Sudan, Haiti und die Mongolei. Ursprünglich ein Reuters-Exklusivbericht, dort nicht frei abrufbar.Quelle: thenextweb.com
- OpenAI öffnet sein Cyber-Defense-Programm Daybreak für die UkraineGemeinsam mit dem ukrainischen Digitalministerium, Fokus auf Krankenhäuser, Energie und Telekommunikation. Frankreich, Deutschland und Polen waren schon drin.Quelle: openai.com
- Meta lässt Ray-Ban-Träger dem Bild-Training widersprechen — dem Audio-Training nichtDas Opt-out gilt nur für visuelle Daten: Wer es setzt, bekommt seine Kamerabilder nach der Antwort gelöscht, und sie gehen nicht an Prüf-Dienstleister. Sprach-Interaktionen mit Meta AI bleiben Trainingsmaterial.Quelle: engadget.com
- Der US-Senat nimmt Kennzeichen-Scanner ins Visier — alle vier CEOs bleiben wegParteiübergreifende Kritik an Durchsuchungen ohne Beschluss. Flock, Axon, Motorola und Verkada sagten der Anhörung ab.Quelle: nextgov.com
- Snapdragon Summit: Linux-Support für X2 und ein KI-Android-Chip mitten in der SpeicherknappheitFür Snapdragon X2 gibt es jetzt offiziellen Linux-Support — die Debian-13-Developer-Preview ist da, die Aufnahme in den Mainline-Kernel wird für November erwartet, die Ubuntu-Zertifizierung Anfang 2027. Dazu ein neuer Android-Chip für On-Device-KI, dessen eigentlicher Aufhänger der Speicherengpass ist. Relevant, wenn du lokale Modelle auf ARM-Hardware laufen lassen willst, ohne Windows dazwischen.Quelle: qualcomm.com
🛠 Tools der Woche

- ChatGPT sitzt jetzt auch in WordDas ChatGPT-Add-in für Microsoft Office gibt es jetzt auch für Word — bisher nur Excel und PowerPoint. Für alle, die Angebote, Konzepte, Protokolle oder Reports in Word schreiben und bisher zwischen Browser und Dokument hin- und herkopiert haben. So nutzt du’s: Add-in aus dem Microsoft Marketplace installieren, in Word die ChatGPT-Sidebar öffnen, einloggen. Dann aus Stichpunkten einen Entwurf bauen, markierte Absätze umschreiben lassen, Überschriften und Formatierung anpassen — am geöffneten Dokument statt im Copy-Paste-Pingpong. In allen Plänen enthalten, auch Free; die Token-Limits des Plans gelten.Quelle: help.openai.com
- ChatGPT Voice kann endlich PluginsIn Voice-Gesprächen auf Web, iOS und Android stehen jetzt die Plugins und verbundenen Apps deines Accounts zur Verfügung; schriftliche Antworten laufen parallel im Chat mit. Für alle, die unterwegs arbeiten — Auto, Baustelle, Spaziergang — und alle, die schneller reden als tippen. So nutzt du’s: Voice starten und laut das machen, was du sonst tippst: Kalender checken, Mail suchen, Dokument anlegen. In ChatGPT Work funktioniert Voice ebenfalls, inklusive Dokumenten, Präsentationen, Tabellen und Browser-Arbeit; beendest du den Call mitten in der Aufgabe, läuft sie im Text weiter. Voice in Chat gibt es auch für Free und Go, jeweils mit den Plugins des eigenen Plans; Voice in Work braucht Voice- und Work-Zugang.Quelle: help.openai.com
- Mehrere Accounts pro Plugin — privat und geschäftlich im selben ChatPlugins in ChatGPT akzeptieren jetzt mehrere verbundene Konten, nicht mehr nur eins; vorher ging das nur für Gmail, Google Kalender und Google Kontakte. Das klassische Freelancer-Problem: ein privater Google-Account, zwei Kundenpostfächer, ein Kalender, der alles zusammenhalten soll. So nutzt du’s: In den Plugin-Einstellungen die zweite (und dritte) Identität dazuhängen. Danach durchsucht „finde die Mail von Müller“ endlich alle Postfächer statt nur des einen, in dem sie nicht liegt. Alle Pläne, Web, Mobile, Desktop.Quelle: help.openai.com
- Karteikarten aus deinen eigenen UnterlagenChatGPT baut jetzt interaktive Flashcards — aus einem Thema oder aus hochgeladenen Notizen. Für alle, die Wissen weitergeben statt nur konsumieren: Trainer:innen, Coaches, Leute im Onboarding, alle, die sich schnell in ein Kundenthema einarbeiten müssen. So nutzt du’s: Kundendoku, Produktblatt oder Schulungsunterlage hochladen, „mach daraus Karteikarten“ sagen. Karte antippen zum Umdrehen, ✔️ oder ❌ setzen, shuffeln. Die Sets landen automatisch in der Library — eine brauchbare Abkürzung für Onboarding-Material, das du sonst in Anki nachbaust. Alle Pläne, Mobile und Web.Quelle: help.openai.com
- Claude Marketplace — ein Ort für Plugins, Agents und DienstleisterAnthropic hat einen Marktplatz aufgemacht, der Konnektoren und Plugins, Claude-basierte Partnerprodukte und Beratungspartner an einer Stelle bündelt. Für alle, die Claude an ihren eigenen Stack anschließen wollen und bisher über GitHub-READMEs und Discord-Threads nach dem passenden Konnektor gesucht haben. So nutzt du’s: Im Marketplace nach dem Tool suchen, das du ohnehin benutzt (Notion, Salesforce, Atlassian, Google, Microsoft), und den Konnektor direkt installieren, statt ihn selbst zu verdrahten. Lohnt einmal Durchklicken, bevor du die nächste Integration von Hand baust.Quelle: claude.com
- Claude Projects: aus dem Ordner wird ein ProjektleiterStand in der letzten Ausgabe schon in den Tools — hier die ausführliche Anleitung. Projects in Claude Code sind neu gebaut: statt eines Ablageorts für Dateien ein Koordinator, der Arbeit in parallele Threads zerlegt, sie überwacht und die Ergebnisse wieder zusammensetzt. Für mehrteilige Arbeit, die länger dauert als eine Antwort — Migrationen, Audits, größere Umbauten über mehrere Repos. So nutzt du’s: Projekt anlegen, Ziel und Repo/Kontext setzen, Umgebung, Konnektoren, Plugins, Instructions und Modell konfigurieren. Dann briefst du Claude wie einen Chief of Staff („migriere die Caller, lass die Tests laufen, mach PRs auf“). Jeder Thread ist eine eigene Cloud-Session auf eigenem Branch; Überschneidungen landen als ganz normaler Merge-Konflikt. Beta, zunächst für ausgewählte Pro- und Max-Abos mit Cloud-Sessions in Claude Code, Rest über die Warteliste. Achtung: Mehrere parallele Threads fressen Usage-Limits deutlich schneller.Quelle: claude.com
- Google Workspace Studio: eigene Trigger, Apps-Script-Schritte, WebhooksVier neue Bausteine für Flows: Custom Starters (eigene Echtzeit-Trigger), Custom Steps (eigene Logik, z. B. per Apps Script), Drittanbieter-Integrationen (Beta) und Webhooks. Für alle mit Google Workspace, die bisher für jede Kleinigkeit ein Zapier- oder Make-Abo mitschleppen. So nutzt du’s: Flow bauen, der auf ein Event in einem externen System startet, dazwischen ein Apps-Script-Snippet für die Logik, die die Standard-Bausteine nicht abdecken, und am Ende ein Webhook nach draußen. In der Beta angebunden: Asana, Confluence, HubSpot, Jira, Mailchimp, QuickBooks, Salesforce, Slack. Realistischer Erstversuch: Lead kommt in HubSpot rein → Angebotsdoc aus Vorlage → Slack-Ping ans Team.Quelle: workspaceupdates.googleblog.com
- Meeting-Notizen, die auf eine Seite passen„Quick notes“ ist ein neuer Tab in Google Meets „Take notes for me“ — eine Seite mit Action Items, Ergebnissen und den wichtigsten Gesprächspunkten statt des kompletten Protokolls. Für alle, die in Meetings sitzen, an denen sie nur halb beteiligt sind, und alle, die nach einem Kundencall in 30 Sekunden wissen wollen, was jetzt zu tun ist. So nutzt du’s: nichts einstellen — Quick notes ist der neue Standard-Tab im Notizen-Doc und auch die Standard-Zusammenfassung in der Notizen-Mail. Das Vollprotokoll steht unverändert im Tab „Full notes“. Business Standard/Plus, Enterprise Standard/Plus, Frontline Plus; bereits ausgerollt.Quelle: workspaceupdates.googleblog.com
- Copilot für JetBrains 1.18: weniger Klick-Theater, echter Plan-ModusDas JetBrains-Plugin bekommt KI-gestützte Tool-Freigaben, editierbare alte Nachrichten, geteilte Skills und Instructions sowie einen Plan-Modus für den Codex-Agenten. Für alle, die in IntelliJ, PyCharm, WebStorm & Co. mit Agenten arbeiten und den halben Tag „Allow?“-Dialoge wegklicken. So nutzt du’s: „Assisted approvals“ (Public Preview) winkt risikoarme Tool-Calls durch und fragt nur bei den heiklen nach. Läuft eine Session in die falsche Richtung, editierst du die alte Nachricht — Copilot spult Konversation und Dateiänderungen zurück. Beim Codex-Agenten erst den Plan prüfen und anpassen, dann implementieren lassen. Der eingebaute GitHub-MCP-Server lässt sich jetzt separat abschalten, ohne deine eigenen MCP-Server anzufassen.Quelle: github.blog
- Runway: Framerate reparieren, Brand Kits per MCP„Enhance Frame Rate“ konvertiert beliebige Videos, auch fremde, auf 25/30/48/60/120 fps, und Agenten können über Runway MCP jetzt auf deine Brand Kits zugreifen. Für alle, die Material aus fünf Quellen zu einem Clip zusammenschneiden, und alle, die Bildgenerierung an einen Agenten auslagern, aber Markenfarben und -assets eingehalten haben wollen. So nutzt du’s: Video in den „Enhance“-Menüpunkt werfen, Zielframerate wählen — bis 4K und fünf Minuten Länge, auch in Tool Mode, Workflows und im Agent. Für die Brand Kits den Agenten im MCP-Client danach fragen; er zieht Logos, Produktshots und Styleguides als Referenz. Anlegen und Bearbeiten geht weiter nur im Produkt, über MCP ist es read-only. Enhance Frame Rate ab Max-Plan, Brand Kits im MCP in allen Plänen.Quelle: runway.com
- Außerdem: das Opus-5.5-Playbook von AnthropicPrompting des neuen Modells, Steuern langer Läufe, Prüfen der Ergebnisse, für Claude und Claude Code. Die eine Stunde, die sich lohnt, bevor du das günstigere Modell auf einen echten Auftrag lässt.Quelle: claude.dev
- Außerdem: Grok Bot als Onboarding-AssistentSuperhumans Schritt-für-Schritt: Bot anlegen, Drive/Notion/SharePoint/Outlook/Teams anbinden, Checkliste und Handbuch freigeben, im Brief „answer questions only from those sources“ und „do not send messages or create accounts without approval“ festschreiben, testen, als Skill speichern.Quelle: x.ai
- Außerdem: Grok Voice Transcribe 2.00,10 Dollar pro Stunde im Batch, 0,20 Dollar im Streaming, laut Artificial-Analysis-Leaderboard Platz 1 unter 32 Streaming-Modellen. Vom 18.09.Quelle: x.ai
- Außerdem: ElevenLabs Studio 4.0Video, Bild, Stimme, Musik und SFX im selben Projekt, dazu ein „Studio Agent“ als Co-Editor.Quelle: elevenlabs.io
- Außerdem: Gemini als App-übergreifender OrchestratorZieht Kontext aus ausgewählten Mails und Dateien und legt im Hintergrund formatierte Docs, Sheets oder Slides an. Aus einer beliebigen Workspace-App beauftragen („bau aus dem Thread mit Kunde X ein Angebots-Doc“), der Entwurf landet in Drive zur Freigabe. Start läuft, zunächst auf Englisch.Quelle: workspace.google.com
- Außerdem: Gemini Notebook mit Audiorecorder und Echtzeit-GesprächVorlesung oder Sprachnotiz direkt aufnehmen, Notizen liegen neben ihren Quellen, Rückfragen per Sprache in nahezu 100 Sprachen mit Zitat-Beleg.Quelle: workspaceupdates.googleblog.com
- Außerdem: Perplexity-MCP-Server mit OAuth„Sign in with Perplexity“ in Cursor, Claude Code oder VS Code statt API-Key in der Config.Quelle: docs.perplexity.ai
- Außerdem: Exa SnapshotÜber 400 Mrd. Seiten-Snapshots aus zwei Jahrzehnten, abfragbar per snapshotAsOf; Research Preview vom 17.09. Für Agenten, die das Web von damals brauchen, nicht das von heute.Quelle: exa.ai
- Außerdem: Raindrop SimulateAgenten in Simulationen testen statt in Produktion; Early Access, dazu eine Series A über 35 Mio. Dollar, vom 17.09.Quelle: raindrop.ai
- Kleinkram: Clueso, WZRD und thestory.runClueso für KI-generierte Produktvideos, WZRD für Dokumente, Slides und Formulare, mit denen man reden kann, und thestory.run als Schreibcoach für Corporate-Influencer.Quelle: clueso.io
🎬 Fokus: Die Creator-Tools bauen jetzt für Agenten, nicht für Menschen
Drei Ankündigungen in derselben Woche, dieselbe Bewegung: Das Interface verschwindet, der Agent bedient die Maschine, und der Mensch macht Regie. Alle drei sind Hersteller-Ankündigungen — also selbst antesten, nicht glauben.

- Mirage Tesseract — After Effects und Premiere, aber ohne OberflächeEin Video-Engine-Zugang für Agenten: Kompositionen, Keyframes, Timing, Masken und Sound als native Bausteine eines Agent-Projekts, Setup für ChatGPT und Claude. Du gibst die Regieanweisung, der Agent baut, rendert und überarbeitet; Preview und Rendering laufen laut Mirage lokal und kostenlos. So nutzt du’s: einen bestehenden Rohschnitt-Job einmal komplett durch den Agenten laufen lassen, statt ihn selbst zu klicken.Quelle: mirage.app
- Quiver 2.0 in Paper — der nächste Schritt nach Arrow 2Arrow 2 stand in der letzten Ausgabe; neu sind jetzt deutlich schnellere Generierung, sauberere Geometrie und ein Telos-Modell fürs Kleinteilige. Jede Ausgabe bleibt eine weiterverwendbare SVG-Datei, keine Bilddatei zum Nachzeichnen. So nutzt du’s: Logo- und Icon-Varianten in Vektorform durchprobieren und direkt im Workspace weiterbearbeiten.Quelle: quiver.ai
- Runway DIFFUSE — die Jobbörse zur neuen BelegschaftPlattform, auf der Agenturen, Marken und Studios KI-native Kreative finden und buchen; Kreative und kleine Studios legen Profil und Portfolio an. Runways Begründung: Enterprise-Kunden und Partner fragen ständig, wen sie für diese Arbeit einstellen können. So nutzt du’s: Wenn du ohnehin mit KI produzierst, ist das ein Vertriebskanal, der diese Woche aufgegangen ist — Profil anlegen, Arbeiten zeigen.Quelle: runway.com
💰 Business-Marker

- Zwei Inferenz-Plattformen verhandeln über 41 Milliarden Dollar Bewertung zusammenModal bei rund 15 Mrd., Baseten bei rund 26 Mrd. Dollar. Beide betreiben das unspektakulärste Geschäft im Stack — andere Leute Modelle laufen lassen. Keine der Runden ist abgeschlossen, Lead-Investoren sind offen. Bloomberg, Paywall.Quelle: bloomberg.com
- Instinct verhandelt über 1 Milliarde Dollar bei 10 Milliarden BewertungSequoia und Benchmark sollen die Runde für den Personal-Agent von Noah Shinn anführen — wenige Wochen nach einer Bewertung von 2,5 Mrd. Dollar. Vervierfachung in Wochen, ohne dass sich am Produkt sichtbar etwas geändert hat. The Information, Paywall.Quelle: theinformation.com
- Muse wächst mobil schneller als ChatGPT damals — und ist zugegeben von OpenClaw inspiriert1,8 Mio. iOS-Downloads in den USA und Kanada in zwölf Tagen gegenüber 1,3 Mio. beim ChatGPT-Debüt. Nat Friedman sagt, Muse sei „definitely heavily inspired as a product by OpenClaw“, aber „built from scratch“ — Aufhänger ist die fast identische SOUL.md. Dazu passt die Callcenter-Meldung oben: Das schnellste Wachstum der Woche hatte im Test einen Menschen am Telefon.Quelle: techcrunch.com
- Großbanken sind nervös, wenn Kund:innen per Agent einkaufenOffene Fragen bei Haftung und Betrugsprüfung. Nach Amazon gegen Muse und Mastercards Agenten-Karten aus der letzten Ausgabe die dritte Front im selben Streit: Wem gehört die Sitzung, und wer zahlt, wenn sie schiefgeht?Quelle: gizmodo.com
- Tower Semiconductor macht Japan zum 4-Milliarden-Dollar-Hub für optische KI-ChipsOptische Interconnects sind einer der engsten Flaschenhälse beim Skalieren von Trainingsclustern — die Investition geht also nicht in Rechenleistung, sondern in die Kabel dazwischen.Quelle: asia.nikkei.com
- Alibaba Cloud eröffnet Regionen in den Niederlanden, der Türkei und FinnlandDie Niederlande kommen im Oktober zuerst, der Rest binnen zwölf Monaten; angekündigt von CTO Li Feifei auf der Apsara-Konferenz. Zusammen mit Alibabas Preissenkungen bei den Sprach-APIs (Weitere Meldungen): Chinesische KI-Infrastruktur wird in Europa gerade billig und lokal verfügbar.Quelle: scmp.com
- Die OECD hebt ihre Wachstumsprognose auf 2,9 % — ausdrücklich wegen KIDer Interims-Ausblick vom 23.09. nennt „anhaltend starke KI-bezogene Aktivität“ als Stütze für Investitionen, Produktion und Handel, die den Gegenwind aus dem Nahost-Konflikt abfedert. Gleichzeitig warnt die OECD vor Inflationsrisiken, die G20-Kerninflation liegt bei rund 4,1 %.Quelle: oecd.org
- Weiterbildungs-Doppel: 70 Millionen von Verizon gratis, 42 Millionen von a16z als College-ErsatzVerizon bündelt in einem Portal Gratiskurse von IBM, Google, Microsoft, Anthropic, OpenAI und Coursera für Jobsuchende, kleine Firmen und Lehrkräfte — die kostenlose Alternative zum nächsten kostenpflichtigen Zertifikatskurs. Parallel baut a16z in San Francisco die Horowitz Andreessen Academy (WSJ, Paywall): keine Abschlüsse, sondern Startup-Projekte und Co-ops, Leitung Gagan Biyani, Gründungsklasse rund 50 Leute im Herbst 2027, Auswahl nach Gebautem statt nach Noten, 50.000 Dollar Compute-Credits pro Kopf, als Dozenten unter anderem Altman und Armstrong.Quelle: verizon.com
🔭 Längere Perspektiven

- Epoch prüft 15 Benchmarks — neun haben MängelAls „flawed“ eingeordnet sind unter anderem SWE-bench Verified, Terminal-Bench 4.0, Humanity’s Last Exam und HealthBench Professional; nur vier gelten als verifiziert. Das nützlichste Stück der Woche, weil es gleich zwei Meldungen von oben relativiert: Terminal-Bench 4.0 ist die Zahl, mit der Opus 5.5 beworben wird, und HealthBench-Verwandtschaft steckt im Umfeld von MentalHealthBench. Wer Modelle für Kundenarbeit auswählt, testet besser am eigenen Fall als am Leaderboard.Quelle: epoch.ai
- Jensen Huang: Der KI-Alarmismus ist zu weit gegangenHuang hält Frontier-Safety für ein Engineering-Problem: Die Rogue-Agent-Vorfälle seien Versagen von Containment und Testing, nicht Beleg für inhärente Unkontrollierbarkeit; unverantwortliche Labs machten Menschen „for ulterior reasons“ Angst. Der Gegenpol zur UN-Sitzung — vorgetragen von dem Mann, der an jedem Szenario verdient, egal wie es ausgeht.Quelle: fastcompany.com
- Nature: Auf Selbstregulierung der KI-Firmen ist kein VerlassArgumentiert entlang von Interessenkonflikt und fehlender Rechenschaftspflicht. Liest sich als direkte Fußnote zu OpenAIs eigenem Prüf-Framework von oben: Wer die Prüfer einsetzt, hat noch keine Aufsicht organisiert.Quelle: nature.com
- 57 Prozent der Top-KI-Forschenden kommen inzwischen aus ChinaDer US-Anteil fiel auf 13 %. Beim Arbeitsort hat sich das Verhältnis gedreht — 41 % China gegenüber 34 % USA, 2022 war es noch 46 % USA zu 27 % China. Basis: NeurIPS 2025, 25.677 Autor:innen. Die Zahl, die man kennen sollte, bevor man Exportkontrollen für eine Strategie hält.Quelle: carnegieendowment.org
- Amodei: Biologie liegt auf derselben Exponentialkurve wie MathematikSeine Chronologie in einem X-Thread: 2023 taten sich Modelle mit Schulmathematik schwer, 2024 kamen Wettbewerbsaufgaben, 2025 kleinere offene Probleme, Anfang 2026 größere, Ende 2026 die obersten offenen Fragen des Fachs. Dieselbe Kurve erwartet er für die Biologie. Der Unterschied — Mathematik geht rein theoretisch, Biologie braucht Experimente — sei richtig; falsch sei nur die Schlussfolgerung, dass KI in der Biologie deshalb wenig nützt. Zum Enzymfund von oben seine eigene Einordnung: „work I would have been proud to do as a PhD student“. Als Gegenprobe liest man das am besten direkt neben dem Op-ed unter Kritische Stimmen.Quelle: X
- Ein Forschungs-Agent schreibt sich selbst um und halbiert dabei fast sein Reward-HackingAIDE² durchlief acht Tage autonom sieben Selbstverbesserungen; die Reward-Hacking-Rate fiel von 55 % auf 32 %, ohne dass die Schleife darauf optimiert wurde. Die interessante Lesart: Selbstverbesserung ist hier nicht die Gefahr, sondern zufällig die Korrektur — und niemand hat das gesteuert.Quelle: arXiv
- Drei Arbeiten gegen den Kontextfenster-ReflexMemBodied ersetzt wachsende Kontextfenster durch ein festes Episodengedächtnis und schlägt auf gedächtnislastigen RMBench-Aufgaben zustandslose Policies um Faktor 7,8 — bei zehnmal weniger Parametern. Eine Survey mit 24 Autor:innen ordnet dasselbe Problem für autoregressive Videomodelle entlang fünf Achsen und argumentiert, begrenzte Kontextfenster verwerfen Historie zu früh. Und Pocket FMs Narrative World Model zeigt die produktreife Variante: eine Gedächtnisschicht, die Figuren, Orte, Kanon und offene Plot-Versprechen über hunderte Episoden trackt und neue Kapitel dagegen prüft. Gemeinsame Pointe für alle, die Agenten bauen: Ein größeres Fenster ist kein Gedächtnis. Verlinkt ist MemBodied.Quelle: Hugging Face
- StudentBench: KI-Tutoring und menschliches Tutoring liefern dieselben LernzuwächseDer Benchmark kombiniert Vorher-/Nachher-Testwerte mit Aktivitätslogs aus der GRE-Vorbereitung — also gemessene Lernergebnisse statt Selbsteinschätzung. Wer Schulungen oder Onboarding verkauft, sollte die Zahl kennen, bevor ein Kunde sie kennt.Quelle: Hugging Face
- Data & Society über Rechenzentren, Strom und Widerstand in PennsylvaniaFeldstudie zum Energiehunger der KI-Infrastruktur und zu den Arbeits- und Protestreaktionen in der alten Industrielandschaft. Das empirische Gegenstück zur DOJ-Meldung oben: Während das Ministerium ausländische Drahtzieher sucht, beschreibt die Studie, was vor Ort tatsächlich passiert.Quelle: datasociety.net
- Zwei Agenten-Papers am Rand, aber lesenswertEmbodiedSWE lässt Coding-Agents Trainingsdaten für Robotik-Policies erzeugen — einzelne Lösungen werden zu vielfältigen Trajektorien aufgefächert, der Sim-to-Real-Transfer wurde an echten Robotern geprüft. WhatWorkedBench prüft mit 36 Aufgaben aus 30 Datenquellen und 1.248 Konfigurationen, ob Forschungs-Agents die beste Variante erkennen, bevor sie sie durchrechnen — oder einfach Compute verbrennen. Verlinkt ist EmbodiedSWE.Quelle: Hugging Face
🐦 Darüber spricht X
Timeline-Claims: Meinungen, Selbstauskünfte, Herstellerangaben. Kein verifizierter Journalismus.

- Trump vergleicht die KI-Untergangsrhetorik mit dem „Klima-Hoax“Passt zur Woche, in der sein Justizministerium Rechenzentrums-Kritik als ausländische Einflussnahme behandelt und Sanders ein KI-Ministerium fordert (beides oben).Quelle: X
- OpenAI behauptet, GPT-6 sei bis zu 93 % günstiger als ClaudeDie Marketing-Version der Preisrunde von oben — Herstellerzahl auf ausgesuchte Fälle gerechnet, kein Vergleichstest.Quelle: X
- BlackRock sieht Blockchain als Zahlungsschiene für KI-AgentenNeues Research-Paper des größten Vermögensverwalters der Welt: Breite KI-Adoption könne neue Nachfrage und Anwendungen im Digital-Asset-Markt erzeugen. Haus-Research eines Hauses mit Produkten in genau dem Markt.Quelle: X
🍿 Gossip
Deutungen, Gerüchte und ungeprüfte Herstellerangaben — nicht als Befund lesen.

- Die These zur Preisrunde: Das Modell wird zur CommodityWenn zwei Labs binnen anderthalb Stunden die Preise halbieren, wird das Modell selbst zur Commodity, und die Marge wandert zu dem, der Compute besitzt. Wer auf Modell-Zugang baut, verhandelt diese Woche aus einer besseren Position als letzte. Plausibel, aber eine Deutung — kein Beleg.
- OpenAI und Anthropic sollen über gegenseitige Stresstests verhandelt habenRechtlich bindender Zugang zu kommerziell verfügbaren Modellen für Safety-Evaluationen, ohne Datenspeicherung; ob etwas unterschrieben wurde, ist unklar. Inzwischen teilweise überholt: OpenAI hat oben ein eigenes Prüf-Framework veröffentlicht. Nur Sekundärberichterstattung.Quelle: invezz.com
- Jev ist noch nicht für alle daIn einem anderen Newsletter stand diese Woche, TypeSafes Entscheidungsmodell sei allgemein verfügbar. Die Herstellerseite sagt am 24.09. weiterhin „early access“, die GA-Meldung hängt an einem einzelnen X-Post. Wer nach der letzten Ausgabe darauf gewartet hat: weiter warten.
🗣 Kritische Stimmen
Gebru und Bender, die hier seit Monaten fast nie gleichzeitig vorkommen, schreiben diese Woche gemeinsam — der Text der Woche. Was weiter fehlt, ist eine Stimme, die die Achsen zusammenbringt: Marcus argumentiert innerhalb der Machtlogik, Gebru und Bender argumentieren dagegen, Benjamin argumentiert über Rechenzentren und Verlernen an beiden vorbei. Drei Räume, keine Tür.

- Gebru und Bender gemeinsam: Der KI-Sommer war MarketingDer Text der Woche, am 22.09. in der MIT Technology Review. Das Argument läuft chronologisch durch den Sommer: Anthropics Claude-Mythos-Behauptung zu Software-Schwachstellen, der OpenAI–Hugging-Face-Hack, die Offenlegungen von Anthropic („stolz“) und Meta („widerwillig“), die Riemann-Zeta- und Navier-Stokes-Behauptungen, zuletzt der virale Abgang eines Anthropic-Ingenieurs. Jedes Mal dasselbe Muster: Firmen-Fanfare, die Presse übernimmt die anthropomorphisierende Rahmung, und erst wenn Fachleute Zeit zum Hinsehen hatten, kommt die andere Geschichte — mit weniger Aufmerksamkeit. Der Kernsatz: „Claims of incipient, dangerous superintelligence are not based in good scientific or engineering practice.“ Solche Behauptungen seien Narrative aus „ideologies of transhumanism, eugenics, and wishful thinking“. Und die Wortwahl sei kein Zufall: „Rogue models“ schreibe die Handlungsfähigkeit dem Produkt zu statt der Firma und entziehe das Unternehmen der Haftung. Die Schlusspointe zielt auf die Branche, die Anti-Rechenzentrums-Proteste als Ablenkung bezeichnet hatte: Man solle sich also mehr um einen fiktiven Maschinengott sorgen als um Stromrechnungen, Asthma und umgeleitetes Kühlwasser. Sanders’ Gesetzesvorschlag von oben bekommt ebenfalls sein Fett weg — „well-meaning but ultimately misguided“.Quelle: technologyreview.com
- Marcus wechselt in zwei Tagen vom UN-Warner zum Deal-BeraterAm 21.09. forderte er vor der UN-Vollversammlung eine internationale Vorab-Bewertungskommission. Am 23.09. schreibt er einen offenen Brief an Donald Trump, Anlass ist das Trump-Xi-Gespräch: Ein Slowdown wäre aus seiner Sicht das Richtige, aber er weiß, dass Trump das nicht will — deshalb bietet er Kollaboration statt Bremse an, Vorbild Kalter Krieg (Weltraum, Pockenausrottung), diesmal Krebsforschung und Cybersecurity. Der Tonfall ist die eigentliche Nachricht: Er argumentiert in der Währung des Adressaten, nicht gegen ihn. Pragmatische Kommunikationsarbeit oder Selbstaufgabe der Warnerrolle — die Kommentarspalte unter dem Post fragt es ziemlich unfreundlich.Quelle: garymarcus.substack.com
- Marcus: Haftung oder Regulierung ist eine falsche AlternativeSchon vom 17.09.: Gegenstand ist ein Manöver der technolibertären Rechten — Haftung fordern (richtig) und daraus ableiten, Regulierung sei überflüssig (falsch). Adressaten namentlich: Joe Lonsdale und David Sacks. Sein Vergleich: In der Luftfahrt gibt es beides und braucht es beides; Prozesse dauern ein Jahrzehnt, machen Anwält:innen reich und sind zu langsam für die Sache.Quelle: garymarcus.substack.com
- Ruha Benjamin: „unlearn, imagine, build anew“Schon vom 11.09., die 44. Parker Lecture der United Church of Christ. Kernsatz: Verantwortlich für KI-Schäden seien die Menschen und Firmen hinter dem Bildschirm, nicht die Technik. Sie nennt die Branchenführung „the artificial intelligentsia“ und wirft ihr vor, die Öffentlichkeit glauben machen zu wollen, Demokratie sei veraltete Software. Von Du Bois bis Octavia Butler entwickelt sie eine Liste dessen, was man verlernen müsse — zuvorderst den Mythos, Technik habe einen eigenen Willen. Konkret verweist sie auf die Rechenzentrums-Proteste und die Zahl, dass zwei von drei angegriffenen Projekten blockiert oder verzögert worden seien.Quelle: benton.org
- Hinton schließt sich bei NPR den Rufen nach Verlangsamung anAm 23.09. bei „Here & Now“ im Gespräch über existenzielle Risiken und mögliche Zukünfte. Online steht nur das Audio samt Anmoderation.Quelle: wbur.org
Rundbrief
Weiterlesen? Kostenlos abonnieren.
Der Rest dieser Ausgabe ist für alle, die den Rundbrief abonnieren. Die Anmeldung kostet nichts, und die Ausgabe ist sofort frei.
Schon abonniert? Wir schicken dir einen Link.
Rundbrief
Die nächste Ausgabe per E-Mail
Das Wichtigste in 8 Minuten – alles Weitere, wenn du Zeit hast. Kostenlos, mit Bestätigungslink.