Der Wettlauf um KI an der Grenze ist vorbei: Netzwerke kleinerer Modelle schlagen zentralisierte KI bei Kosten und Leistungsfähigkeit

Andrew Trask argumentiert, dass zentralisierte KI-Unternehmen – Fable, Mythos, GPT, Opus – die Leistungsgrenze dauerhaft verloren haben. Mit gerouteten/gewichteten Ensembles günstigerer Modelle kann nun jeder die Genauigkeit jedes einzelnen Spitzenmodells zu geringeren Kosten und höherer Geschwindigkeit übertreffen.
Wichtige Erkenntnisse aus dem Artikel
- Fähigkeit: Eine differenziell private Kombination von Spitzenmodellen erreichte bei Humanity's Last Exam niedrige 50er Werte – höher als jedes einzelne Modell. Der Artikel zeigt eine Grafik, in der ein Ensemble aus GPT und Opus Fable/Mythos zum halben Preis übertrifft.
- Geschwindigkeit: OpenRouters unabhängige Geschwindigkeitsbewertungen zeigen, dass Open-Source-Modelle schneller sind, weil Hosting-Anbieter um niedrige Latenz konkurrieren.
- Kosten: Der günstigste Weg, um Fable/Mythos-Niveau zu erreichen, sind nicht mehr diese Modelle – es ist ein Ensemble aus GPT-5.5 + Opus + Kimi K2.7, das heute veröffentlicht wurde und Fable bei Benchmarks schlägt.
Die Spielanleitung
- Nimm ein beliebiges Spitzen-KI-Modell (z. B. Fable).
- Finde das nächstbeste günstigere Spitzenmodell (z. B. Opus oder GPT-5.5).
- Kombiniere es mit einem führenden Open-Source-Modell (z. B. Kimi K2.7) und einem Router.
- Ergebnis: ein günstigeres, leistungsfähigeres System – das man beliebig oft rekursiv wiederholen kann.
Warum zentralisierte KI nicht reagieren kann: Der Hydra-Effekt
Trask vergleicht zentralisierte KI mit den Mainframes der 1960er Jahre. Sobald das Internet Mainframes verband, war das Netzwerk immer stärker. Ähnlich ist es, sobald man jede Kombination von Modellen ensembleieren kann: Kein einzelnes Modell kann je aufholen – jede Verbesserung eines einzelnen Modells nährt nur das Ensemble.
Der Artikel stellt klar: „Kein einzelnes Spitzen-KI-System wird jemals wieder die Leistungsgrenze erreichen, wegen der Skalierungsgesetze/Ensembles.“ Er prognostiziert, dass die Zukunft der „netzwerkgestützten KI“ gehört – Netzwerken von neuronalen Netzen, analog zur PC+Internet-Ära.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Claude-Code-Cache-Fehler können die API-Kosten um das 10- bis 20-fache erhöhen
Zwei Cache-Fehler in Claude Code können API-Kosten stillschweigend um das 10- bis 20-fache erhöhen. Die Probleme wurden auf Reddit gemeldet und auf Hacker News diskutiert.

OneUptime fügt in einem einzigen Commit 12.000 KI-generierte Blogbeiträge hinzu
OneUptimes Blog-Repository fügte in einem einzigen Commit 12.000 KI-generierte Beiträge zu ClickHouse, Redis, MongoDB, MySQL und anderen Technologien hinzu, die 5.012 Dateien und über 1 Million Codezeilen veränderten.

Claude für Word Add-in: Beweise in Analytics API gefunden
Die Analyse-API von Anthropic liefert jetzt Metriken für Claude für Word neben den bestehenden Add-Ins für Excel und PowerPoint, was darauf hindeutet, dass die Word-Integration in Entwicklung ist. Die API zeigt Null-Nutzungszahlen für Word, was darauf schließen lässt, dass sie noch nicht öffentlich verfügbar ist.

Agentisches Codieren ist eine Falle: Kognitive Schulden und Atrophie
Lars Faye argumentiert, dass agentische Codierungswerkzeuge wie Claude Code zu kognitiver Atrophie, Vendor Lock-in und erhöhter Komplexität führen und die Last vom Schreiben von Code auf das Überprüfen generierten Codes verlagern, was die Fähigkeiten der Entwickler beeinträchtigt.