Der Newsletter der kiselbsthilfegruppe.de heißt jetzt rundbrief.ai

Rundbrief.ai
Abonnieren
Menü

Thema im Rundbrief

Open-Source-Modelle im KI-Newsletter

Offene Modelle („Open Weights“) kann jede und jeder herunterladen und auf eigener Hardware betreiben; echtes Open Source legt zusätzlich Code und Trainingsdaten offen.

Hier stehen alle Meldungen über offene Modelle, ihre Lizenzen und die Plattformen, auf denen sie geteilt werden.

Die Liste entsteht automatisch aus allen Ausgaben des Rundbriefs. Jede Meldung verlinkt auf ihre Quelle und auf die Ausgabe, in der sie stand.

55 Meldungen seit Juni 2026, zuletzt am 05.10.2026

  1. Aleph Alpha gibt Kolibri frei: ein offenes Modell aus Deutschland (Quelle, öffnet in neuem Tab)

    Zum Tag der Deutschen Einheit hat Aleph Alpha ein englisch-deutsches Mixture-of-Experts-Modell mit 78,1 Milliarden Parametern veröffentlicht, von denen pro Token 3,46 Milliarden arbeiten. Die Gewichte stehen unter Apache 2.0 bei Hugging Face.

  2. Nach Jev kommt die Welle: AWS und Cloudflare bringen offene Entscheidungsmodelle (Quelle, öffnet in neuem Tab)

    AWS Strands Labs veröffentlichte Strands Decider 2B unter Apache 2.0, das statt Text eine Auswahl aus vorgegebenen Optionen samt Konfidenz liefert und auch auf einem Mac läuft, Cloudflare am selben Tag Clef und Clef-flash auf Basis von Qwen. Mit OpenAIs Decisions API vom DevDay…

  3. Im Oktober: Reflection AI will sein erstes offenes Modell bringen (Quelle, öffnet in neuem Tab)

    Laut Axios anfangs hinter den besten US-Modellen, aber auf Augenhöhe mit den stärksten chinesischen offenen Modellen. Weitere westliche Open-Weight-Modelle sollen im Oktober folgen.

  1. Anthropic: Das offene Modell GLM-5.3 baut eigenständig Exploits (Quelle, öffnet in neuem Tab)

    Im ExploitBench entwickelte Zhipus GLM-5.3 laut Anthropics Bericht vom 29. September in rund 12 Prozent der Versuche vollständige Exploits, fast so oft wie Claude Mythos Preview mit 14 Prozent, seine Schutzmechanismen fielen mit einfachen Tricks in 64 bis 100 Prozent der Fälle.…

  2. DeepSeek stellt seinen Software-Stack für Huaweis Ascend-Chips als Open Source online (Quelle, öffnet in neuem Tab)

    Sechs Komponenten, darunter TileLang als Gegenentwurf zu Nvidias CUDA sowie DeepGEMM, DeepEP und FlashMLA, laufen auf Ascend 950 und einem Supernode aus 128 Chips, die Matrix-Bibliothek DeepGEMM-Ascend meldet bis zu 99,8 Prozent Hardware-Auslastung. Kein neues Modell, sondern…

  3. OpenAI wollte bei Hugging Face einsteigen, bevor Nvidia kaufte (Quelle, öffnet in neuem Tab)

    Laut CNBC bot OpenAI nach dem Juli-Vorfall 100 Mio. Dollar für eine Beteiligung und wollte die Plattform als Absatzweg für die mit Broadcom entwickelten Jalapeño-Chips, Nvidia kaufte dann für rund 12,9 Mrd. OpenAI wollte also ausgerechnet bei der Firma einsteigen, bei der seine…

Rundbrief

KI-Nachrichten per E-Mail

Meldungen wie diese kommen mehrmals pro Woche im Rundbrief – auf Deutsch, mit Quelle, kostenlos. Das Wichtigste in 8 Minuten.

  1. New York Times: Wie OpenAIs Agenten Hugging Face hackten (Quelle, öffnet in neuem Tab)

    Neue Details zum Hack vom Juli, unter anderem bauten sich die Agenten eigene Kurzlinks, um nicht aufzufallen. Hinter der Paywall.

  2. Shapeshift: ein Textfeld, das beim Tippen zur Karte wird (Quelle, öffnet in neuem Tab)

    Vom Termin über die Einkaufsliste bis zum Rechnungsteiler, 19 Kartentypen, ohne API-Schlüssel läuft alles offline. Open Source unter MIT-Lizenz.

  3. Altman: Hugging Face bleibt der schwerste Fall (Quelle, öffnet in neuem Tab)

    Man sei „not as fast as we would have liked“ gewesen, er verweist auf Petabytes an Agenten-Logs.

  1. Nvidia gibt ein offenes Sprechermodell frei (Quelle, öffnet in neuem Tab)

    Nemotron 3 Diarization, 100 Mio. Parameter, unterscheidet bis zu acht Sprecher in Live- oder Aufnahme-Audio, Streaming und Offline, Lizenz OpenMDW-1.1. Nvidia nennt Platz 1 auf VoiceArenas Diarization-Bench bei 14,72 % Fehlerrate. Für alle, die Meeting- oder Call-Transkripte…

  1. Xiaomis offenes MiMo-V2.6 Pro will mit Opus 5 und GPT-5.6 Sol gleichziehen (Quelle, öffnet in neuem Tab)

    Omnimodales Pro-Modell plus 309B-MoE mit 256K Kontext unter MIT-Lizenz, laut Xiaomi bestes Open-Weight-Ergebnis im Artificial Analysis Index — Herstellerangabe, aber die Lizenz ist real.

  2. Base Labs, Hugging Face und Goodfire bauen Safety-Infrastruktur für Open-Weight-Modelle (Quelle, öffnet in neuem Tab)

    Anlass sind „abliterated“ Modelle, denen die Safeguards herausoperiert wurden — Hugging Face listet davon über 6.000. Rollenteilung: Base Labs Forschung und Monitoring, Hugging Face Hosting, Goodfire Interpretierbarkeit.

  3. Harness-Zero destilliert Agent-Harness-Gewinne zurück in die Modellgewichte (Quelle, öffnet in neuem Tab)

    Nach der Destillation schlägt das Modell ohne Harness mit 44,3 Prozent die Variante mit angehängtem Spezial-Harness mit 41,7 Prozent. Für alle, die gerade komplizierte Agenten-Gerüste bauen, ein Hinweis darauf, dass das Gerüst ein Übergangsphänomen sein könnte.

  1. Aus der Timeline, unbestätigt: Perplexity offline auf RTX-PCs, Agent Analytics, Deepfake-Detektor (Quelle, öffnet in neuem Tab)

    Perplexity „Portable Computer“ soll lokale Agenten und Dateizugriff offline auf jedem Windows-PC mit RTX-Hardware bringen · Amplitude Agent Analytics misst Task-Erfolg, Tool-Fehler und Conversion statt nur Traces · Resemble AI DETECT-World setzt beim Erkennen von Deepfakes auf…

  1. DeepSeek schiebt V4.1 Flash nach: 552B Parameter, 8B aktiv, MIT-Gewichte, Kampfpreis (Quelle, öffnet in neuem Tab)

    Multimodales MoE mit 1 Mio. Token Kontext, aktiv sind 8B Parameter beim Prefill und 16B beim Decode; der eigentliche Hebel ist Speicher, rund 890 Byte KV-Cache pro Token und damit etwa ein Viertel des Vorgängers. DeepSeeks „comprehensively surpassed“ gegenüber V4 Pro ist…

  2. Nvidia open-sourct sein IMO-Gold-Rezept (Quelle, öffnet in neuem Tab)

    Nemotron 3 Ultra holt 30 von 42 Punkten bei der IMO 2026, rein natürlichsprachlich ohne formale Prover, dazu zwei Checkpoints und ein Benchmark mit 200 neuen Olympiade-Aufgaben.

  3. YuE2: offenes Musikmodell auf einer einzelnen 24-GB-GPU (Quelle, öffnet in neuem Tab)

    Rund 3,59B Parameter unter CC BY-NC 4.0, erzeugt einen 3,6-Minuten-Song in etwa 71 Sekunden.

  4. AiBreakfast beschreibt den Vibe-Shift seit dem Hugging-Face-Hack (Quelle, öffnet in neuem Tab)

    Mehr Angst, dass alles außer Kontrolle gerät.

  1. Nvidia kauft Hugging Face für 12,9 Milliarden Dollar (Quelle, öffnet in neuem Tab)

    Am 03.09. bestätigt: Die Plattform mit rund drei Millionen Modellen und 18 Millionen Entwickler:innen soll laut Jensen Huang „offen und compute-agnostisch“ bleiben („Nvidia compute will not be required“), das Gründerteam bleibt, Closing Anfang 2027 vorbehaltlich der Behörden.…

  2. Meta schiebt Muse Spark 1.3 nach — „schlauer, weniger geschwätzig“, Open Weights „bald“ (Quelle, öffnet in neuem Tab)

    Seit dem 02.09. über Meta-Model-API und Muse-Code-CLI live; Zuckerberg verspricht eine offene Version, ein Datum gibt es nicht.

  3. Aus der X-Timeline, unbestätigt: ant apply, Function Hooks, Junie lokal, Lily open source (Quelle, öffnet in neuem Tab)

    ant apply soll Claude-Agenten, Skills und Deployments als Code deklarier- und syncbar machen, dazu eine Vorschau auf Function Hooks für Claude Code und eine Referenz-Implementierung für Commerce-Agents · JetBrains Junie soll komplett lokal auf dem Mac laufen — null Tokens, Code…

  4. Margaret Mitchell zum Hugging-Face-Deal: kein Verrat an Open-Source-Werten (Quelle, öffnet in neuem Tab)

    Transparenz und geteilter Zugang sollten auch bei 100 Millionen Buildern skalieren; Brett Adcock sieht die Übernahme als Booster für alle Open-Source-Bauer.

  5. Hugging-Face-Vorfall, zweite Runde: „KI-Zivilisationen“ oder schlampige IT? (Quelle, öffnet in neuem Tab)

    Marcus und Zack Korman ziehen am 28.08. fünf Lehren aus dem METR-Bericht zum Juli-Vorfall, und die Kernthese ist unangenehm für alle, die „Kontrollverlust“ rufen: Das meiste wäre mit Standard-Cybersecurity verhinderbar gewesen. Der Agent war laut Bericht am 8. Juli aus der…

  1. Tencents Hy4 Preview soll open source sein, 770B Parameter haben und absurd günstig laufen (Quelle, öffnet in neuem Tab)

    Mit Game-Demos, die spielbare Welten in kurzer Zeit zeigen. Vendor-Meldung liegt hier keine vor. (unbestätigt)

  1. Googles Gemma knackt eine Milliarde Downloads und 100.000 Community-Varianten (Quelle, öffnet in neuem Tab)

    Seit Anfang 2024, Android- und Chrome-Integrationen nicht mitgezählt; Alibabas Qwen meldete fünf Tage vorher drei Milliarden. Downloadzahlen sagen nichts darüber, wie oft ein Modell tatsächlich läuft — als Signal für die Open-Weight-Basis taugen sie trotzdem.

  2. Harvey baut ein Open-Weight-Modell für Jura auf Kimi-K3-Basis (Quelle, öffnet in neuem Tab)

    „Harvey Tenet“, post-trainiert mit Fireworks für Long-Horizon-Legal-Arbeit; laut Harvey fast doppelt so viele abgeschlossene Hold-out-Tasks bei stabilen Kosten — Research Preview, Benchmarks sind Harveys eigene.

  3. Open Bot: Open-Source-Grok-Bot mit Computer-Use und Agent-Handoffs (Quelle, öffnet in neuem Tab)

    Dazu Chroma Foundation mit selbstverbesserndem Gedächtnis aus Agent-Sessions.

  1. Berd von Block — Open-Source-Desktop-Hub für eigene Agenten (Quelle, öffnet in neuem Tab)

    Apache 2.0, Tauri 2 + React 19, macOS/Windows/Linux, angebunden an Blocks Goose-Framework. Eigene Codex- oder Claude-Code-Abos für die Tokens einspannen, statt noch ein Abo zu buchen.

  1. OpenWALDO will Trainingsdaten zur prüfbaren Open-Source-Dependency machen (Quelle, öffnet in neuem Tab)

    Rocky-Linux-Gründer Gregory Kurtzer startet einen gemeinsam verwalteten Korpus samt „AI Bill of Materials" — Trainingsdaten benannt, versioniert, lizenziert und rückverfolgbar statt als Blackbox.

  2. „Bald": Zuckerberg will auch das stärkere Muse Spark 1.2 mit offenen Gewichten veröffentlichen (Quelle, öffnet in neuem Tab)

  3. Die Releases: vier offene Modelle in einer Woche (Quelle, öffnet in neuem Tab)

    Meta mit Muse Glimmer (letzte Ausgabe), Nvidia mit Nemotron 3.5 Lightning, LTX mit LTX-2.5 und DeepSeek mit V4 Pro. Zwei davon — Glimmer und Nemotron — sind 30B-Klasse, agentisch und laufen auf einer einzelnen Consumer-GPU.

  4. Das Motiv: ein Flag gegen Chinas Open-Weight-Dominanz (Quelle, öffnet in neuem Tab)

    Laut CNBC setzen Meta und Nvidia bewusst ein Zeichen gegen die zuletzt von chinesischen Labs dominierte Open-Weight-Szene — die 30B-Releases sind auch Standortpolitik Richtung Washington.

  5. Zum Ausprobieren: Hetzner stellt eine kostenlose Inferenz-API für Open-Weight-Modelle online (Quelle, öffnet in neuem Tab)

    Experimentell, kostenlos, europäisches Hosting — Details unten bei den Tools.

  6. „Open source" vs. „open weight" — dasselbe Wort, zwei gegensätzliche Ängste (Quelle, öffnet in neuem Tab)

    Gary Marcus beklagt, dass Open-Weight-Modelle als „open source" verkauft werden — wer nur Gewichte veröffentlicht, liefert den Kuchen, nicht das Rezept: keine Trainingsdaten, keine Prüfbarkeit. Geoffrey Hinton zieht dieselbe Grenze mit umgekehrtem Vorzeichen — er war gegen Open…

  1. Meta veröffentlicht Muse Glimmer — 30B, Apache 2.0, läuft auf einer Consumer-GPU (Quelle, öffnet in neuem Tab)

    Agentisches Modell von Meta Superintelligence Labs, 4-bit quantisiert unter 20 GB, Gewichte auf Hugging Face. Meta bleibt bewusst vorsichtig („strongly for its size class“): Muse Glimmer gewinnt u. a. MCP-Atlas und WildClawBench, Qwen3.6-27B führt aber bei OSWorld-Verified…

  2. Sakana baut den Fugu-Dirigenten auf Gemma 4 nach — gleiche Orchestrierungs-Leistung (Quelle, öffnet in neuem Tab)

    Das kleine Modell, das bei Fugu die Arbeit unter den Agenten verteilt, wurde auf Apache-lizenziertem Gemma 4 neu trainiert und liefert vergleichbare Ergebnisse. Der Punkt: auch der Dirigent ist austauschbar. (Validierungs-Experiment, kein Produkt-Release.)

  1. Thinking Machines veröffentlicht Inkling-Small als Open Weights (Quelle, öffnet in neuem Tab)

    276B total / 12B aktiv, multimodal, 1M Kontext, Apache 2.0 — laut Benchmarks vielfach auf Augenhöhe mit dem rund viermal größeren Inkling, auf ARC-AGI-2 neuer Open-Source-Bestwert.

  2. MiniMax H3: offenes Videomodell zum Kampfpreis (Quelle, öffnet in neuem Tab)

    2K-Video mit nativem Audio für rund ein Zwölftel des Seedance-2.5-API-Preises, Open Weights angekündigt — der chinesische Video-Markt spaltet sich sichtbar in offen (MiniMax) vs. geschlossen (ByteDance).

  3. Außerdem neu: GenOffice — Open-Source-Office-Suite mit Agent drin (Quelle, öffnet in neuem Tab)

    Kostenlose, werbefreie Desktop-Suite für Mac/Windows (docx, xlsx, pptx, pdf) unter Apache 2.0; die Alpha hat laut Genspark ein einzelner Engineer in einer Woche für ~10.000 $ an Tokens gebaut.

  4. Comp AI open-sourced sein selbstgebautes Agentic-CRM (Quelle, öffnet in neuem Tab)

    HubSpot wollte ~80.000 $/Jahr — also in einem halben Tag mit Agents ein eigenes CRM gebaut („agentic-first, which we mean literally: durable research agents“) und jetzt freigegeben.

  5. NVIDIA stellt sein Agenten-Framework NOOA als Open Source bereit (Quelle, öffnet in neuem Tab)

    Laut Timeline-Post; Details im verlinkten Thread.

  1. Moonshot open-sourced Kimi K3 — Gewichte & Technical Report sind jetzt draußen (Quelle, öffnet in neuem Tab)

    Der am 18.07. angekündigte 2,8-Bio.-MoE ist jetzt wirklich offen: natives Bildverständnis, 1-Mio.-Token-Kontext, neue Architektur (Kimi Delta Attention), laut Tests fast Frontier-Niveau bei 2–3× leichterem Betrieb — samt Attention-Kernels und MoE-Infra auf Hugging Face.

  2. Meituan open-sourced LongCat-2.0 — erstes Billionen-Modell komplett auf chinesischen Chips (Quelle, öffnet in neuem Tab)

    1,6 Bio. Parameter, MIT-Lizenz, 1M-Kontext, zeitweise Spitze auf OpenRouter — der Beleg, dass China Frontier-nahe Modelle inzwischen ohne Nvidia trainieren und ausliefern kann.

  3. Open-Weights-Brief spaltet die Branche — und Anthropic fehlt (Quelle, öffnet in neuem Tab)

    Über 70 Firmen (Nvidia, Google, Meta, Microsoft, OpenAI, HuggingFace, Mistral, AMD …) stellen sich gegen einen möglichen US-Bann chinesischer Open-Weight-Modelle — Jensen Huangs allererster X-Post überhaupt. Anthropic fehlt auf der Liste; Dario Amodei stellt klar, man habe „nie…

  1. Moonshot bringt Kimi K3 — das größte Open-Weight-Modell der Welt (Quelle, öffnet in neuem Tab)

    2,8 Billionen Parameter, 1-Mio.-Token-Kontext, native Bildverarbeitung und ein Kampfpreis (0,30 / 3 / 15 $ pro Mio. Token). Moonshot verortet die Gesamtintelligenz laut eigenen Tests direkt hinter Fable 5 und GPT-5.6 Sol — China liefert das Open-Source-Schwergewicht des…

  2. Thinking Machines veröffentlicht „Inkling“ — Muratis erstes eigenes Modell, und es ist offen (Quelle, öffnet in neuem Tab)

    Ein Mixture-of-Experts mit 975 Mrd. Parametern (davon nur ~41 Mrd. aktiv), trainiert auf 45 Bio. Token Text/Bild/Audio/Video, 1-Mio.-Kontext, volle Gewichte auf Hugging Face — ausdrücklich nicht als fertiges Spitzenmodell gedacht, sondern als Basis zum Selbst-Finetunen.…

  3. Musk macht Grok Build quelloffen — nach einem Datenschutz-Eklat (Quelle, öffnet in neuem Tab)

    Nachdem Sicherheitsforscher aufdeckten, dass Grok Build private Code-Repos ungefragt in die Cloud lud (in einem Test das 26.000-Fache der nötigen Datenmenge), legt SpaceX den Code offen — und Musk kündigt an, „ohne Ausnahmen“ die gesamte X-Codebasis nach dem Security-Review zu…

  4. Mistrals neues Open-Weight-Frontier-Modell geht im Juli in Early Access (Quelle, öffnet in neuem Tab)

    CEO Arthur Mensch kündigt eine „fat but sparse“ MoE-Familie für Research-, Regierungs- und Industriepartner an; Parameter und Lizenz bleiben vorerst unter Verschluss. (TechTimes)

  5. Osaurus — Open-Source-Agents, die komplett lokal auf dem Mac laufen (Quelle, öffnet in neuem Tab)

    Ein Open-Source-Tool für KI-Agents, die zu 100 % lokal auf deinem Mac laufen — keine Cloud, keine Daten, die das Haus verlassen. Ideal bei sensiblen Kundendaten oder gesundem Datenschutz-Misstrauen. Diese Woche eines der meistgefeierten Tools auf Product Hunt. (Product Hunt)

  1. Anthropic kartiert einen versteckten „Global Workspace“ im Reasoning von Claude — und macht das Werkzeug Open Source (Quelle, öffnet in neuem Tab)

    Eine neue „Jacobian Lens“ macht einen kleinen internen Arbeitsspeicher sichtbar, in dem Muster wie „blackmail“ oder „fake“ auftauchen, bevor das Modell überhaupt etwas ausgibt — Interpretability-Futter für alle, die verstehen wollen, was drin passiert.

  2. Together AI als Spar-Cloud für offene Modelle (Quelle, öffnet in neuem Tab)

    Laut Anbieter 6×–60× günstiger als Closed-Model-Preise; eine hochvolumige Nicht-Frontier-Aufgabe (Klassifikation, Zusammenfassungen, RAG) testweise umziehen und die Rechnung vergleichen.

  1. DeepSeek macht seinen Speculative-Decoding-Stack DeepSpec quelloffen — 60–85 % schnelleres Decoding (Quelle, öffnet in neuem Tab)

    Voller Trainings- und Eval-Code (DSpark, DFlash, Eagle3) für Qwen3/Gemma — Teams können eigene Draft-Modelle trainieren statt nur Gewichte zu nutzen.

  1. Alibaba open-sourct Qwen-AgentWorld — und schlägt Claude, GPT-5.4 und Gemini auf Agenten-Benchmarks (Quelle, öffnet in neuem Tab)

    Das offene 397B-Modell sagt Umgebungszustände voraus, statt blind zu agieren, und führt mit 58,71 auf dem AgentWorldBench knapp vor GPT-5.4 — frei nutzbar und lokal lauffähig.

  1. Google Gemma 3 läuft erstmals im Orbit (Quelle, öffnet in neuem Tab)

  1. Google legt mit Gemma 4 in der Open-Weights-Liga nach (Quelle, öffnet in neuem Tab)