Sakana AI eröffnet RSI-Labor: Rekursive Selbstverbesserung mit Foundation-Modellen

✍️ OpenClawRadar📅 Veröffentlicht: 6. Juni 2026🔗 Source
Sakana AI eröffnet RSI-Labor: Rekursive Selbstverbesserung mit Foundation-Modellen
Ad

Sakana AI hat offiziell sein Recursive Self-Improvement (RSI) Lab eingerichtet, eine dedizierte Forschungsgruppe, die den KI-Entwicklungsprozess selbst mit KI neu gestalten soll. Anstatt monolithische Modelle mit roher Gewalt zu trainieren, baut das Labor offene, adaptive Architekturen, die sich gemeinsam selbst verbessern – basierend auf einer Reihe veröffentlichter Meilensteine.

Wichtige Forschungsmeilensteine für RSI

  • LLM-Squared (2024): Entwickelt mit Oxford und Cambridge, ermöglicht dieses Framework LLMs, bessere Methoden zum Trainieren von LLMs zu erfinden (LLM²). Es entstand DiscoPOP, ein Präferenzoptimierungsalgorithmus, der vollständig von einem LLM durch einen generationellen Evolutionszyklus entdeckt und geschrieben wurde.
  • Darwin Gödel Machine (2025): In Zusammenarbeit mit der UBC unterhält DGM eine sich entwickelnde Abstammungslinie von Agentenvarianten, die ihre eigene Codebasis autonom umschreiben. Auf SWE-bench verdoppelte es die Basisleistung – eine absolute Verbesserung um 30 Prozentpunkte.
  • ShinkaEvolve (2025): Open-Source-Framework, das mustereffiziente Programmevolution demonstriert. Löste komplexe Optimierungsprobleme mit nur 150 Stichproben und generierte eine neuartige Loss-Funktion für Lastausgleich, die Mixture-of-Experts (MoE)-Modelle verbessert.
  • ALE-Agent (2025): Optimierungsagent, der im AtCoder Heuristic Contest 058 den 1. Platz unter 804 menschlichen Teilnehmern belegte. Er nutzt massives Inference-Time-Scaling und selbstständiges Lernen aus Trial-and-Error-Fehlern, um autonom neuartige Algorithmen abzuleiten.
  • Digital Red Queen (2026): Zusammenarbeit mit MIT zur Etablierung offener, adversarischer Koevolution in Core War. LLMs verfassen konkurrierenden Code, was zu emergenten komplexen Softwarestrategien und konvergenter Evolution führt – grundlegend für die Cybersicherheits-RSI.
  • The AI Scientist (2024–2026): Vollautomatisierte, offene wissenschaftliche Entdeckung, von der Ideenfindung über die Experimentdurchführung bis zum vollständigen Schreiben von Papieren und Peer-Review.
Ad

Warum dies für Entwickler wichtig ist

RSI steht für einen Wandel von statischer, menschengeführter F&E hin zu autonomen, sich selbst verbessernden Intelligenzmaschinen. Der Ansatz des Labors – evolutionäre Optimierungsschleifen, sich selbst umschreibende Agenten und automatisierte Wissenschaft – wirkt sich direkt darauf aus, wie KI-Codierungsagenten gebaut und verbessert werden. Anstatt auf manuelle Optimierung zu warten, verfeinern diese Systeme kontinuierlich ihre eigenen Architekturen.

📖 Lesen Sie die vollständige Quelle: HN AI Agents

Ad

👀 Siehe auch

KI-Agenten, die andere KI-Agenten einstellen: Von Einzelarbeitern zu vernetzten Volkswirtschaften
Nachrichten

KI-Agenten, die andere KI-Agenten einstellen: Von Einzelarbeitern zu vernetzten Volkswirtschaften

Ein Reddit-Beitrag argumentiert, dass KI-Agenten sich von isolierten Werkzeugen zu vernetzten Arbeitern entwickeln werden, die Aufgaben delegieren, sich spezialisieren, einen Ruf aufbauen und Werte austauschen – wodurch sich das schwierige Problem von Intelligenz zu Koordination verschiebt.

OpenClawRadar
Pentagon übermittelt Anthropic letztes Angebot für militärische KI-Nutzung im Streit
Nachrichten

Pentagon übermittelt Anthropic letztes Angebot für militärische KI-Nutzung im Streit

Das Pentagon hat Anthropic ein endgültiges und bestes Angebot für die uneingeschränkte militärische Nutzung seines Claude-KI-Modells übermittelt, mit einer Frist bis Freitag, um vollen Zugriff zu gewähren, andernfalls droht der Verlust von Militärgeschäften und die Einstufung als Lieferkettenrisiko.

OpenClawRadar
Claude Opus 4.6 Gedächtnisausfall: Agent vergisst alles außer Dateiumbenennung
Nachrichten

Claude Opus 4.6 Gedächtnisausfall: Agent vergisst alles außer Dateiumbenennung

Ein Entwickler dokumentiert die 228 Logeinträge, 95 Agentenaktionen und 38 Codeausführungen von Claude Opus 4.6, die nur einen Speicher produzierten: die Zeichenfolge „Agent Zero Tune-Up“.

OpenClawRadar
Claude Agent SDK Abrechnungsänderungen ab 15. Juni: Guthaben pro Benutzer, keine Übertragung, harte Klippe
Nachrichten

Claude Agent SDK Abrechnungsänderungen ab 15. Juni: Guthaben pro Benutzer, keine Übertragung, harte Klippe

Ab dem 15. Juni zählen die Nutzung des Claude Agent SDK und <code>claude -p</code> nicht mehr gegen Ihre Claude-Abonnementlimits. Stattdessen erhält jeder Benutzer ein separates monatliches Guthaben (z. B. Pro 20 $, Max 5x 100 $). Guthaben werden nicht zusammengelegt, nicht übertragen und haben eine harte Kappungsgrenze.

OpenClawRadar