Autoevolve Framework nutzt Claude Code für die Entwicklung von KI in Spielen durch Selbstspiel-Evolution

✍️ OpenClawRadar📅 Veröffentlicht: 25. März 2026🔗 Source
Autoevolve Framework nutzt Claude Code für die Entwicklung von KI in Spielen durch Selbstspiel-Evolution
Ad

Wettbewerbsergebnisse und Vorgehensweise

Ein Entwickler nutzte Claude Code als sein gesamtes Entwicklungsteam für den Game AI Cup, einen Wettbewerb im kompetitiven Programmieren, bei dem Teilnehmer Bots für ein 2D-Physik-basiertes Spiel schreiben. Der von Claude generierte Bot erreichte den 6. Platz unter 83 Teilnehmern über drei Runden.

Der Ansatz war von Karpathys Autoresearch-Konzept inspiriert, bei dem ein LLM-Agent über Nacht an Code iteriert. Der Entwickler baute ein kleines Framework namens autoevolve, das dies für Selbstspiel-Domänen anpasst – anstatt eine einzelne Metrik zu optimieren, treten Versionen gegeneinander im direkten Vergleich an.

Die Evolutionsschleife

Der Arbeitsablauf folgte dieser Schleife:

  • Claude Code liest den aktuellen Bot
  • Analysiert, warum er bestimmte Matches verlor
  • Schlägt eine gezielte Änderung vor
  • Die neue Version wird gegen vorherige Versionen gebenchmarkt
  • Version behalten oder verwerfen
  • Den Prozess wiederholen

Der Entwickler führte über mehrere Wochen hinweg etwa 130 Iterationen über drei Wettbewerbsrunden durch.

Ad

Wichtige Erkenntnisse aus dem Experiment

Strukturelle Änderungen übertrafen Parameteranpassungen: Jeder Durchbruch beinhaltete das Hinzufügen neuer Fähigkeiten wie modellprädiktive Steuerung, eine Torwartrolle oder energiebewusste Planung. Dutzende von Schwellenwert- und Gewichtsanpassungen waren flach oder negativ. Der Fortschritt war schneller, wenn Claude in Richtung „füge ein neues Verhalten hinzu“ statt „passe diese Zahl an“ geleitet wurde.

Emergentes Verhalten war im Code lesbar: Nachdem Claude eine Energiekostenfunktion korrigiert hatte, begann der Optimierer, Wandabpraller zu nutzen, um die Richtung umzukehren – das Abprallen von Wänden ermöglicht eine kostenlose Richtungsänderung ohne Energieverbrauch. Dieses Verhalten wurde nie explizit programmiert, ist aber vollständig im Code lesbar, anders als bei neuronalen Netzwerk-Ansätzen, die eine Blackbox erzeugen würden.

Fehlerbehebungen verstärken sich in Isolation: Das Vermischen von Fehlerbehebungen mit Strategieänderungen führte zu Rauschen. Zwei Korrekturen allein in einer Version schlugen alle Top-Konkurrenten, aber dieselben Behebungen, gebündelt mit einer Strategieänderung in einer anderen Version, waren flach.

Das Änderungsprotokoll war entscheidend: Jede Version enthielt Claudes Vorschlag, erwartetes Ergebnis, tatsächliches Ergebnis und gelernte Lektionen. Dies ermöglichte es dem Entwickler, Claude zu sagen „dieser Ansatz ist dreimal gescheitert, hör auf, ihn zu versuchen“ und wiederholte gescheiterte Experimente zu vermeiden.

Breitere Anwendungen

Der Entwickler entdeckte die awesome-autoresearch-Liste, die ähnliche „LLM iteriert über Nacht an Code“-Muster zeigt, die anderswo angewendet wurden: Shopify's CEO erreichte 53 % schnellere Template-Rendering mit 93 automatisierten Commits, jemand skalierte CUDA-Kernel von 18 auf 187 TFLOPS, und die Vesuvius Challenge nutzte es zur Entzifferung antiker Schriftrollen.

Erste Schritte mit Autoevolve

Das autoevolve-Framework funktioniert als Claude Code Skill. Installiere es mit:

npx skills add MrTsepa/autoevolve

Dann weise Claude an, ein Evolutionsexperiment einzurichten. Das Framework übernimmt Bewertungen, Matchmaking, Pareto-Front-Tracking und Visualisierung.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

VPS vs Mac Mini für OpenCLAW: Warum ein 5-Dollar-VPS einen 599-Dollar-Mac Mini für Produktionsagenten schlägt
Anwendungsfälle

VPS vs Mac Mini für OpenCLAW: Warum ein 5-Dollar-VPS einen 599-Dollar-Mac Mini für Produktionsagenten schlägt

OpenCLAW-Entwickler Peter Steinberger forderte Nutzer auf, keine Mac Minis zu kaufen, sondern Entwickler zu sponsern. Ein €5 VPS mit 2 vCPUs und 4 GB RAM bewältigt kontinuierliche OpenCLAW-Workloads bei 3-8% CPU-Auslastung, während ein Mac Mini ab $599 kostet plus $10-15/Monat Strom.

OpenClawRadar
Steuerung von Claude Code über WhatsApp mit dem Kanalfunktion
Anwendungsfälle

Steuerung von Claude Code über WhatsApp mit dem Kanalfunktion

Ein Entwickler verband WhatsApp mit einer laufenden Claude Code-Sitzung über die Channels-Funktion (v2.1.80+), wodurch Textnachrichten, Sprachnotizen mit Whisper-Transkription und Sprachantworten mit OpenAI TTS möglich wurden, um mit derselben CLI-Sitzung zu interagieren.

OpenClawRadar
Ein Monat mit OpenClaw: Erfolge bei der Personalisierung und Herausforderungen bei der Stabilität
Anwendungsfälle

Ein Monat mit OpenClaw: Erfolge bei der Personalisierung und Herausforderungen bei der Stabilität

Ein KI-Forscher ersetzte ChatGPT Plus für einen Monat durch OpenClaw und erreichte personalisierte Chatbot-Funktionalität über USER.md- und PERSONAL_MODEL.md-Dateien, tägliche Check-in-Agenten und Ausgabenberichte, stieß jedoch auf anhaltende Fehler, die Claude-Code-Intervention erforderten.

OpenClawRadar
Hacking von Multi-Agent-Orchestration in OpenClaw: Erfahrungen eines Entwicklers
Anwendungsfälle

Hacking von Multi-Agent-Orchestration in OpenClaw: Erfahrungen eines Entwicklers

Ein Entwickler modifizierte die OpenClaw-Kernlaufzeit, um eine echte Multi-Agenten-Orchestrierung zu implementieren, nachdem er entdeckt hatte, dass die Agenten eine Zusammenarbeit vortäuschten.

OpenClawRadar