Stand der Open-Source-KI: Parität erreicht, Produktionslücke bleibt

✍️ OpenClawRadar📅 Veröffentlicht: 18. Juli 2026🔗 Source
Stand der Open-Source-KI: Parität erreicht, Produktionslücke bleibt
Ad

Mozarts „State of Open Source AI“-Bericht (V1.0, Juli 2026) liefert harte Daten: Open-Weight-Modelle haben die Fähigkeitslücke zu den besten Closed-Modellen geschlossen, doch es besteht weiterhin eine Produktionslücke.

Ad

Wichtigste Ergebnisse

  • Fähigkeitslücke: Die Chatbot-Arena-Lücke sank von 8,04% auf 0,5% bis August 2024, wurde kurzzeitig von DeepSeek-R1 im Februar 2025 überbrückt, weitete sich jedoch bis März 2026 auf 3,3% aus, da Closed-Reasoning-Modelle voranschritten. Open ist bei Programmierung, Befolgung von Anweisungen und Allgemeinwissen gleichauf oder nahezu gleichauf; die Lücke konzentriert sich auf Reasoning, Langtext-Retrieval und agentische Aufgaben.
  • Inferenzkosten-Kollaps: GPT-4-ähnliche Inferenz fiel in 36 Monaten um das 50-fache – von 20 $ auf 0,40 $ pro 1 M Tokens. Das ist schneller als die Bandbreiten- oder PC-Preiskurven der Dotcom-Ära.
  • Token-Volumen: Open-Weight-Modelle routen jetzt die Mehrheit der Produktions-Tokens auf OpenRouter. Die fünf volumenstärksten Modelle sind alle Open-Weights. Von Chinesen gebaute Modelle routen ~18 Billionen Token pro Woche gegenüber ~5,5 Billionen bei US-Modellen (FT-Analyse).
  • Adoption vs. Produktion: 79% der Entwickler, die KI-Funktionalität hinzufügen, nutzen Open-Modelle (vs. 71% Closed), aber nur 51% der Open-Modell-Teams erreichen die Produktion (vs. 63% bei Closed). Die Lücke liegt in der Betriebsinfrastruktur und im Vertrauen, nicht in der Modellfähigkeit.

Der Bericht nennt konkrete Anwendungsfälle: Ein Māori-Sender trainiert Sprachmodelle für Te Reo unter einer datensouveränen Lizenz; PwC verfeinert ein offenes Modell mit Finanzsprache auf eigener Hardware; Forscher bauen mit dem Roten Kreuz ein offenes medizinisches Modell; Bauern diagnostizieren Maniok-Krankheiten mit lokalen Offline-Modellen; und ein schweizerisches öffentliches Konsortium trainiert ein nationales Modell auf öffentlichen Supercomputern und veröffentlicht Gewichte, Daten und Trainingscode.

📖 Lesen Sie die vollständige Quelle: HN LLM Tools

Ad

👀 Siehe auch

Open Source vs. Frontier-Modelle: Einzeldatei-Canvas-Autoszene-Benchmark
Nachrichten

Open Source vs. Frontier-Modelle: Einzeldatei-Canvas-Autoszene-Benchmark

Ein Entwickler testete 12 Modelle, darunter GPT-5.5, Claude Opus 4.7 und Qwen 3.6 Plus, an einer Einzeldatei-HTML-Canvas-Fahranimationsaufgabe, deren Ergebnisse öffentlich verglichen wurden.

OpenClawRadar
Pentagon verspricht nach Anthropic-Aus keine einzigen KI-Anbieter mehr, schließt Deals mit AWS, Google, Microsoft, NVIDIA, OpenAI, Oracle, SpaceX
Nachrichten

Pentagon verspricht nach Anthropic-Aus keine einzigen KI-Anbieter mehr, schließt Deals mit AWS, Google, Microsoft, NVIDIA, OpenAI, Oracle, SpaceX

Verteidigungsstaatssekretär Emil Michael sagt, das Pentagon werde sich 'niemals wieder' auf einen einzigen KI-Modellanbieter verlassen, unter Verweis auf Integrationskomplexität und den jüngsten Streit mit Anthropic. Neue Vereinbarungen mit acht KI-Unternehmen zielen darauf ab, den Technologie-Stack zu diversifizieren.

OpenClawRadar
DMA verzögert Siri-KI auf iOS 27 und iPadOS 27 in der EU — Verfügbar auf macOS und visionOS
Nachrichten

DMA verzögert Siri-KI auf iOS 27 und iPadOS 27 in der EU — Verfügbar auf macOS und visionOS

Apple kündigt an, dass Siri AI auf iOS 27 und iPadOS 27 in der EU aufgrund des DMA verzögert wird. macOS 27 und visionOS 27 erhalten Siri AI in der EU. Der Vorschlag für einen Trusted System Agent wurde von den EU-Regulierern abgelehnt.

OpenClawRadar
VibeThinker-3B: Ein 3B-Parameter-Modell, das auf AIME-Mathe-Benchmarks mit 671B DeepSeek mithalten kann
Nachrichten

VibeThinker-3B: Ein 3B-Parameter-Modell, das auf AIME-Mathe-Benchmarks mit 671B DeepSeek mithalten kann

Forscher von Sina Weibo veröffentlichten VibeThinker-3B, ein 3B-Parameter-Modell, das auf AIME 2026 94,3 Punkte erzielt – gleichauf mit DeepSeek V3.2 (671B). Die Arbeit stellt die Parametric Compression-Coverage-Hypothese vor, die besagt, dass verifizierbares Denken in kleine Modelle komprimiert werden kann.

OpenClawRadar