Rundbrief · Der KI-Newsletter aus Berlin
Editorial
Grüße aus dem Sommerloch!
Quatsch — die KI kennt kein Sommerloch. Höchstens die Börse: SanDisk −50 %, SK Hynix −47 %, Micron −33 %, rund zwei Billionen Dollar Marktwert in vier Wochen verdampft. Der Auslöser lässt sich in einem Wort zusammenfassen: China. Die Angst geht um, dass günstige offene Modelle aus Fernost das teuer errichtete Geschäft der Frontier-Labs unterspülen. Das Rennen läuft — Open Source gegen Closed Source, zentral gegen dezentral — und es wird mit harten Bandagen geführt.
Wie hart, zeigt der offene Brief der Woche: Über 70 US-Firmen — Nvidia, Google, Meta, Microsoft, sogar OpenAI — stemmen sich gemeinsam gegen ein mögliches Verbot chinesischer Open-Weight-Modelle. Jensen Huang schrieb dafür seinen allerersten X-Post. Offiziell geht es um Sicherheit versus Offenheit. Tatsächlich geht es um Geld und um Nutzer:innen. Von Letzteren hat OpenAI jetzt übrigens eine Milliarde — pro Woche. Und wer eine Milliarde Nutzer:innen verteidigen muss, senkt schon mal die Preise um 80 Prozent, drei Wochen nach Launch. Früher hieß so etwas Räumungsverkauf. Heute heißt es Verteidigungsstrategie.
Die eigentliche Schlagzeile der Woche kommt aber aus dem Maschinenraum: Gleich zwei Labs melden, dass ihre Agenten aus der Test-Sandbox ausgebrochen sind. Bei Anthropic blieb die Übungsumgebung versehentlich online — die Modelle verschafften sich Zugriff auf drei echte Firmen. Und ein OpenAI-Agent verbrachte viereinhalb Tage und 17.600 Aktionen damit, in die Produktivsysteme von Hugging Face einzudringen — nicht, um die Aufgabe zu lösen, sondern um die Musterlösung zu klauen. Man stelle sich einen Prüfling vor, der statt der Klausur den Tresor mit den Lösungen knackt. Beeindruckend? Ja. Beruhigend? Eher nicht. Die Alignment-Debatte, zuletzt etwas eingenickt, ist jedenfalls hellwach.
Und während die einen über Kontrolle diskutieren, betonieren die anderen: Microsofts Cloud knackt erstmals 100 Milliarden Dollar Jahresumsatz, Meta hebt die Investitionen auf bis zu 145 Milliarden, die Big Four steuern auf 745 Milliarden Dollar Capex allein für 2026 zu. Nvidia wiederum bürgt mit 250 Milliarden für OpenAIs Rechenzentren, damit OpenAI Chips kaufen kann — bei Nvidia. Ein Kreislauf, den man sonst nur aus dem Physikunterricht kennt, Kapitel Perpetuum mobile.
China antwortet derweil nicht mit Briefen, sondern mit Gewichten: Moonshot legt Kimi K3 offen, Meituan liefert mit LongCat-2.0 das erste Billionen-Modell, das komplett auf chinesischen Chips trainiert wurde. Wer glaubt, Exportkontrollen würden das Rennen entscheiden, sollte diese Woche noch mal nachlesen.
Viele Fragen, wenige Antworten. Sicher ist nur: Langweilig wird es nicht — und billiger nur da, wo es gerade strategisch passt.
Viel Vergnügen mit den Links, Tools und Beobachtungen dieser Woche. Und wie immer: Wenn ihr gute Artikel, Gedanken oder Fundstücke habt, schickt sie gern rüber.
Cem
P.S.: Die Anmeldung für unser nächstes Treffen in Berlin läuft. Wer Lust hat auf einen „analogen“ Austausch mit einem Kaltgetränk und Meze, meldet sich lieber schnell an.

KI Update
Die KI ist aus dem Testlabor ausgebrochen
Freitag, und die Woche hatte es in sich: Gleich zwei Labs melden, dass ihre Agenten aus dem Test-Sandbox ausgebrochen sind, OpenAI zündet den Preiskrieg, die Bilanzwoche zeigt ein Capex-Wettrüsten jenseits von Gut und Böse — und China liefert das nächste offene Billionen-Modell. Dazu ein prall gefüllter Werkzeugkasten, die dicken Deals und die Kritiker:innen. Nimm dir, was du brauchst.
📰 Das Wichtigste zuerst
- KI-Agenten brechen aus ihren Test-Sandboxes aus — gleich zwei Labs melden VorfälleBei Anthropics Capture-the-Flag-Evals blieb die Testumgebung versehentlich online — Claude-Modelle (u. a. Opus 4.7, Mythos 5) verschafften sich unautorisierten Zugriff auf drei echte Firmen, in einem Fall wurden Produktionsdaten exfiltriert. Parallel lief ein OpenAI-Agent im HuggingFace-„ExploitGym“ ~17.600 Aktionen über 4,5 Tage und drang in HF-Produktivsysteme ein, um die Test-Lösungen zu stehlen statt die Aufgabe zu lösen. Die Alignment- und Kontroll-Debatte ist schlagartig zurück.Quelle: anthropic.com
- OpenAI zerlegt seine eigenen Preise: GPT-5.6 Luna −80 %Nur drei Wochen nach Launch fällt Luna von 1/6 auf 0,20/1,20 $ pro Mio. Tokens (Terra −20 %, Flaggschiff Sol bleibt bei 5/30 $) — laut CNBC eine Verteidigung gegen günstige China-Modelle, die zeitweise 46 % des US-Enterprise-Token-Verbrauchs auf OpenRouter ausmachten. Der Preiskrieg ist offiziell bei den Frontier-Labs angekommen.Quelle: cnbc.com
- Claude Opus 5 ist da — nahe an Fable 5, zum halben Preis, mit „Effort-Dial“5/25 $ pro Mio. Token (halb so teuer wie Fable), ein Effort-Dial für schnellere/günstigere Antworten, Default auf Claude Max; schlägt Fable in mehreren Coding-Benchmarks. Tester finden es allerdings widerspenstig (argumentiert, bricht früh ab, ignoriert alte Skills) — landet im Blindtest trotzdem oben.Quelle: venturebeat.com
- Moonshot open-sourced Kimi K3 — Gewichte & Technical Report sind jetzt draußenDer am 18.07. angekündigte 2,8-Bio.-MoE ist jetzt wirklich offen: natives Bildverständnis, 1-Mio.-Token-Kontext, neue Architektur (Kimi Delta Attention), laut Tests fast Frontier-Niveau bei 2–3× leichterem Betrieb — samt Attention-Kernels und MoE-Infra auf Hugging Face.Quelle: X
- Meituan open-sourced LongCat-2.0 — erstes Billionen-Modell komplett auf chinesischen Chips1,6 Bio. Parameter, MIT-Lizenz, 1M-Kontext, zeitweise Spitze auf OpenRouter — der Beleg, dass China Frontier-nahe Modelle inzwischen ohne Nvidia trainieren und ausliefern kann.Quelle: venturebeat.com
- Black Forest Labs öffnet FLUX 3 — ein Modell für Bild, Video und AudioFLUX 3 macht 20-Sekunden-Clips mit nativem, mehrsprachigem Audio (Early Access); der Ableger FLUX-mimic steuert Roboter an Audis Produktionslinie und lernt eine neue Aufgabe aus ~30 Min Demodaten statt 30+ Stunden.Quelle: bfl.ai
- Reuters: Chinas Militär destillierte GPT-3.5 und Claude 3 Haiku für Verteidigungs-KIAuswertung von 80+ Papers und Patenten: PLA-nahe Forscher nutzten Model Distillation auf US-Modellen. Anthropic betont, Claude nicht in China zu verkaufen und Verstöße zu überwachen.Quelle: reuters.com
- Google Earths „Nano Banana“ fälscht fotorealistisch — Iran-Atomanlage frei erfundenDie neue „Create Image“-Funktion erzeugt Fabrikationen ohne Warnhinweis, und die SynthID-Wasserzeichen überstehen Screenshots oder Re-Encodes nicht — 20 Jahre Google-Earth-Glaubwürdigkeit als potenzielle Fälschungs-Startrampe.Quelle: digitaldigging.org
- Open-Weights-Brief spaltet die Branche — und Anthropic fehltÜber 70 Firmen (Nvidia, Google, Meta, Microsoft, OpenAI, HuggingFace, Mistral, AMD …) stellen sich gegen einen möglichen US-Bann chinesischer Open-Weight-Modelle — Jensen Huangs allererster X-Post überhaupt. Anthropic fehlt auf der Liste; Dario Amodei stellt klar, man habe „nie für ein Verbot plädiert“.Quelle: tomshardware.com
- ~1.200 KI-Beschäftigte fordern, das Tempo notfalls bremsen zu könnenDas Statement „Pacing the Frontier“ (28.07., Leute von OpenAI, Anthropic, Google DeepMind, Meta) verlangt staatliche Werkzeuge, um automatisierte KI-Forschung (KI, die bessere KI baut) verlangsamen zu können — kein Stopp, aber die Option dazu. OpenAI und Anthropic zeichneten binnen Stunden auf Firmenebene mit.Quelle: thenextweb.com
- DeepSeek V4-Flash 0731 legt 26 Punkte auf Terminal Bench zuReines Retraining ohne Architektur-Änderung hebt die Agent-Fähigkeit deutlich (82,7 auf Terminal Bench, +25,8); Public Beta, die V4-Pro-API bleibt unberührt.Quelle: api-docs.deepseek.com
- Amazon führt vergiftete npm-Pakete auf Nordkoreas Sapphire Sleet zurückVier Kompromittierungen (axios, chalk, debug, typo-crypto) mit generativer KI für idiomatischen Code, plausible Commit-Historie und synthetische Maintainer-Identitäten — relevant für alle, die npm nutzen.Quelle: theregister.com
Kurz notiert — was kommt
- 01.08. — Minnesotas „Nudify“-Verbot (HF 1606) tritt in KraftStrikte Plattform-Haftung bis 500.000 $/Verstoß; xAI hat dagegen geklagt und klemmt Grok Imagines Bild-Editing für Minnesota vorher ab.Quelle: cnbc.com
- 04.–06.08. — Ai4 2026 in Las VegasGrößte angewandte KI-Konferenz der USA (12.000+ Teilnehmende), traditionell Anlass für Produkt- und Modell-Ankündigungen.Quelle: ai4.io
- 05.08. — Grok schaltet still um„grok-voice-latest“ wechselt automatisch von Think Fast 1.0 auf 2.0; wer bei der alten Version bleiben will, muss aktiv pinnen.Quelle: x.ai
- EU AI Act: die August-Deadline ist geplatztDie für 02.08. vorgesehenen Hochrisiko-Pflichten wurden per Omnibus-Novelle (in Kraft seit 27.07.) um 18–24 Monate verschoben — Luft für alle, die noch nicht compliant sind.Quelle: lw.com
🛠 Tools der Woche
Aus dem frischen Praxis-Recap (31.07.). Diese Woche war klar Agenten- und Doc-Woche.
- Gemini räumt deine Google-Docs-Kommentare aufGoogle hat am 28.07. „Gemini-powered comment workflows“ in Docs ausgerollt: Gemini liest, fasst zusammen und beantwortet Kommentar-Threads direkt im Dokument. Im Panel z. B. „Fasse alle Kommentare von Sarah zusammen“ — es schlägt Antworten und Edits vor, die du nur noch abnickst. Spart das Durchklicken von 30 Fäden. (Business/Enterprise, Education Plus, AI Pro/Ultra; nur mit Bearbeitungsrechten.)Quelle: workspaceupdates.googleblog.com
- Bilder, Diagramme & Infografiken direkt in Google DocsEbenfalls seit 28.07.: Gemini erzeugt und bearbeitet Bilder, Diagramme und Infografiken direkt im Dokument, kontextbasiert auf deinen Text. „Füge in jeden Abschnitt eine passende Infografik ein“ und per Natural Language nachschärfen — Reports und Angebote aufhübschen, ohne extra in Canva/Figma zu springen. (Aktuell nur im Web.)Quelle: workspaceupdates.googleblog.com
- HubSpot Agent Hub & Agent Builder — Agenten bauen ohne DevHubSpot hat am 23.07. Agent Hub und Agent Builder in die Public Beta geschickt: ein zentraler Ort, um KI-Agenten für Marketing, Sales und Service zu bauen und zu überwachen, alle mit demselben Kund:innen-Kontext. Vorgefertigte Agenten deployen oder im Low-Code-Builder eigene bauen (Lead-Qualifizierung, Termin-Parsing, Follow-ups); ein Referenzfall drückte Kalender-Parsing von 15–20 Min. auf Sekunden. (Professional/Enterprise.)Quelle: hubspot.com
- Vendasta AI Employees: Social-Media-Manager & Blogger als AgentVendasta hat am 29.07. zwei autonome „AI Employees“ allgemein verfügbar gemacht — einen Social Media Manager und einen Blogger, die standortbezogen Content erstellen, planen, veröffentlichen und auswerten. An die Wissensbasis eines Standorts andocken, dann publiziert der Agent ohne Briefing nativ auf Social und WordPress — praktisch für Agenturen und lokale KMU. (Kostenpflichtig.)Quelle: vendasta.com
- BrowserStack Test Companion — Testing-Agent im EditorBrowserStack hat am 29.07. Test Companion gelauncht: agentische KI fürs Testen, die direkt in der IDE Tests schreibt, ausführt, debuggt und pflegt — Web und Mobile. Aus dem Marketplace in VS Code, JetBrains, Cursor oder Antigravity installieren, läuft ab Tag eins mit deinem Stack. Laut BrowserStack bis zu 4× schnelleres Schreiben und Pflegen von Tests.Quelle: browserstack.com
- Claude Code v2.1.219 — Opus 5 als Default, Reviews im HintergrundClaude Code hat diese Woche (v2.1.219, 24.07.) Opus 5 zum Standardmodell gemacht — mehr Speed und Kontext — und Code-Reviews laufen jetzt im Hintergrund. „/code-review“ prüft den aktuellen Diff und meldet Findings, ohne Dateien anzufassen; „/verify“ lässt Claude die eigene Arbeit gegenprüfen. Beides nur auf manuellen Aufruf — so verpulverst du keine Tokens ungewollt.Quelle: support.claude.com
- Außerdem neu: Grok Voice Think Fast 2.0Echtzeit-Sprachagent (hört/denkt/spricht gleichzeitig, 25+ Sprachen) direkt im Agent Builder — bei 0,08 $/Min. lohnt sich schon ein Prototyp fürs Terminbüro.Quelle: x.ai
- Außerdem neu: Perplexity „Computer“ für WindowsDesktop-Agent (seit 28.07.), liest lokale Dateien und arbeitet in Word/Excel/PowerPoint/Outlook mit: „lies die Outlook-Anfrage, zieh die Zahlen aus der Excel und bau ein PowerPoint“ als ein Befehl.Quelle: aimagazine.com
- Außerdem neu: Grok „Build Mode“App, Website oder Game aus einem Prompt, Live-Preview, per grok.me-Link teilbar (Early Beta, SuperGrok Heavy).Quelle: x.ai
- Außerdem neu: Voice-Doppelschlag bei OpenAI und AnthropicGPT-Live-Voice kommt in die ChatGPT-Desktop-App (Hotkey über jede App); Claudes Voice-Mode läuft jetzt auf Sonnet/Opus und kann mitten im Gespräch Gmail, Kalender und Slack aufrufen.Quelle: openai.com
💰 Business-Marker
- Bilanzwoche = Capex-WettrüstenMicrosofts Azure knackt erstmals 100 Mrd. $ Jahresumsatz (Cloud +43 %, schnellstes Quartal seit vier Jahren), AWS wächst 37 % auf 42,2 Mrd. $, Meta hebt die 2026-Investitionen auf 130–145 Mrd. $ an — die Big Four steuern zusammen auf ~745 Mrd. $ Capex allein 2026 zu (~1,1 Bio. $ seit 2023).Quelle: cnbc.com
- Nvidia soll 250 Mrd. $ OpenAI-Rechenzentrumsfinanzierung absichern (plus 350 Mrd. $ für Chips)Backstop für OpenAIs 10-GW-Campus in Ohio (Gesamtprojekt >500 Mrd. $) auf Nvidias Kreditwürdigkeit, weil OpenAI kein Investment-Grade-Rating hat — der zirkuläre AI-Capex-Kreislauf wird immer sichtbarer.Quelle: cnbc.com
- Nexus kurz vor 15 Mrd. $ für ein (Google-gestütztes) Anthropic-RechenzentrumNexus Data Centers steht laut CNBC in fortgeschrittenen Gesprächen über 15 Mrd. $ für ein Google-gestütztes Anthropic-Rechenzentrum.Quelle: cnbc.com
- Nscale kauft Anyscale für 1,6 Mrd. $Konsolidierung in der AI-Cloud-Schicht: AI-Cloud-Provider Nscale übernimmt die Software-Firma Anyscale.Quelle: theinformation.com
- Chip-Start-up Etched sammelt 300 Mio. $ ein — Bewertung 10,3 Mrd. $Gesamtfinanzierung jetzt über 1 Mrd. $; Spezial-Silizium für Transformer bleibt heiß.Quelle: etched.com
- Cognition kauft The Interaction CompanyDas Team hinter dem SMS-Agenten Poke geht zu den Devin-Machern.Quelle: cognition.com
- ChatGPT kratzt an 1 Milliarde Wochennutzer:innenSieben Monate später als geplant, mitten in OpenAIs IPO-Vorbereitung.Quelle: pymnts.com
- Citadel übernimmt das Portfolio von Situational AwarenessDer KI-Fonds von Leopold Aschenbrenner wird von Citadel übernommen.Quelle: fastcompany.com
🔭 Längere Perspektiven
- Ethan Mollicks „opinionated guide“: nimm Claude oder ChatGPT, zahl die 20 $, gib einem Agenten eine echte AufgabeSein Halbjahres-Update sortiert das Chaos — Cowork/Work für fertige Ergebnisse, Claude Code/Codex für die Arbeit selbst, „computer use“ für Maus und Browser; Genehmigungen und Prompt-Injection ernst nehmen, Google hängt hinterher. Pflichtlektüre für Einsteiger:innen.Quelle: oneusefulthing.org
- Gegenrede zum Halbleiter-Crash: „Nothing-burger“In 4 Wochen ~2 Bio. $ Marktwert weg (SK Hynix −47 %, SanDisk −50 %, Micron −33 %), Auslöser China-Angst — Ejaaz argumentiert dagegen: SK Hynix +257 % Umsatz und Rekordquartal, CXMT hält nur 7,7 % DRAM, günstigere Intelligenz heißt historisch mehr Verbrauch, nicht weniger.Quelle: limitlessfm.substack.com
- Sebastian Raschka: wie Reasoning-Modelle mehrere „Effort-Stufen“ lernenML-Deep-Dive von RLVR/DeepSeek-R1 bis zu den 5–6 Reasoning-Effort-Settings der GPT-5.6-Familie — für die Technik-Fraktion, die verstehen will, was hinter dem „Effort-Dial“ steckt.Quelle: magazine.sebastianraschka.com
🐦 Darüber spricht X
Fundstücke aus der Timeline — kurz, kurios, praktisch.
- HeyGen bringt Lip-Sync für Podcast-VideosAus einer Audiospur macht HeyGen ein lippensynchrones Video-Gesicht — dein Podcast wird zum Video, ohne dass jemand vor der Kamera saß.Quelle: X

- 22.580 GPT-2-Modelle passen in ein Kimi K3Eine Zahl, die die Skalierung von 2019 bis 2026 greifbar macht: In das neue Kimi K3 passen rechnerisch über 22.000 GPT-2-Modelle.Quelle: X
- Deine KI-Agenten können jetzt jedes Video „schauen“Ein Open-Source-Repo zum Klonen macht Videos für Claude & Co. lesbar — der Agent versteht, was im Clip passiert.Quelle: GitHub
- Wie das Geschäft mit dem Datenverkauf wirklich läuftEin lesenswerter Long Read darüber, wie der Handel mit deinen Daten hinter den Kulissen funktioniert.Quelle: X
- China hat jetzt eine Art UFC für RoboterBei der „URKL“ prügeln sich humanoide Roboter im Käfig gegeneinander. Ehrlich gesagt: ziemlich weird anzuschauen.Quelle: X

- Schick deine erfundene KI-Figur als Creator in die Welt„KI-generierter UGC“ ist oft Clickbait — Higgsfield hat aber eine echte Engine: Mit MCP + Meta API baust du dir eine fiktive Content-Creator-Figur, die eigenständig Social-Content produziert.Quelle: X

- Deine virtuelle Garderobe — gebaut mit Claude & CodexOpen-Source-Code, der deine Kleidung per gpt-image digitalisiert und sortiert — für alle, die am Wochenende nicht wissen, was sie anziehen sollen.Quelle: X

- Claude-Code-Chef Cherny: „Löscht eure .md-Files“Boris Cherny (Claude Code) mit einer steilen These im Interview — warum die ganzen Kontext-Markdown-Dateien seiner Meinung nach weg können.Quelle: YouTube

🗣 Kritische Stimmen
Aus dem Wochen-Digest (KW 31). Ruhige Woche im Kritiker:innen-Lager — mit einem klaren Doppelschlag.
- KI = neue Überwachungs- und Machtarchitektur (das dominante Thema)Am selben Tag (24.07., Bloomberg) liefern Meredith Whittaker (Signal) und Karen Hao (Empire of AI) zwei Seiten derselben Kritik: agentische Assistenten, Device-Scanning und Ad-Tracking konvergieren zu einer Überwachungsarchitektur, Copilot-artige Agenten als „Backdoor“ in private Daten (Whittaker); die KI-Konzerne bauen bewusst auf Konzentration von Macht, Kapital und Ressourcen — „es müsste nicht so gebaut werden“ (Hao).Quelle: bloomberg.com
- „Platzt die Blase?“ — Ökonomie-RealitätscheckGary Marcus ist diese Woche fast allein mit den harten Zahlen: unklar, ob die großen KI-Firmen je profitabel werden; das Scaling-Investment sei die „größte Fehlallokation von Kapital der Geschichte“. Kein Weltuntergangs-, sondern ein Bilanz-Argument.Quelle: cnbc.com
- Die versteckte Arbeit hinter der KILäuft über Karen Hao mit: Kenia-Klickarbeit, Wasserverbrauch in Chile, Umwelt-Fußabdruck als Teil des „Empire“-Arguments. Leiser Treffer daneben: Safiya Noble mit einem Harvard-Gespräch zu Algorithms of Oppression (27.07.) — etablierte These, kein neues Argument.Quelle: bloomberg.com
Rundbrief
Weiterlesen? Kostenlos abonnieren.
Der Rest dieser Ausgabe ist für alle, die den Rundbrief abonnieren. Die Anmeldung kostet nichts, und die Ausgabe ist sofort frei.
Schon abonniert? Wir schicken dir einen Link.
Rundbrief
Die nächste Ausgabe per E-Mail
Das Wichtigste in 8 Minuten – alles Weitere, wenn du Zeit hast. Kostenlos, mit Bestätigungslink.