Claude-KI-Agenten bauen Simulator, optimieren Spielalgorithmus, um menschliche Punktzahl zu übertreffen

Ein Entwickler testete, ob KI-Agenten Menschen im Programmier-Spiel The Farmer Was Replaced übertreffen könnten. Da KI-Agenten Schwierigkeiten haben, grafische Benutzeroberflächen direkt zu bedienen, bestand die Strategie darin, ein Team von Claude-Agenten zunächst einen Python-basierten Simulator erstellen zu lassen, der die Spielmechanik und -regeln perfekt widerspiegelte. Sobald der Simulator fertig war, sollte ein zweites Agententeam ihn nutzen, um iterativ einen optimalen Algorithmus für die Ernte von Sonnenblumen zu entwickeln und zu entdecken.
Entwicklungsprozess und Herausforderungen
Der Prozess begann mit einem Experiment, bei dem die „Agententeams“-Funktion von Claude Code genutzt wurde, um ein einfaches Tic-Tac-Toe-Spiel zu erstellen, was erfolgreich war und Vertrauen für das komplexere Landwirtschaftsprojekt schuf. Die Hochskalierung brachte jedoch Herausforderungen mit sich: Der Teamleiter der Agenten wurde zum Engpass, verbrauchte 91 % der Sitzungstokens und versäumte es, proaktiv menschliches Feedback einzuholen, um den Simulator an das echte Spiel anzupassen. Nachdem der Entwickler erkannte, dass die Agententeam-Infrastruktur für diese spezifische Aufgabe zu überkompliziert und teuer wurde, wechselte er zurück zu Cursor und einem direkteren Prompting-Ansatz, um den Simulator erfolgreich fertigzustellen.
Ergebnisse und Algorithmus-Iterationen
Claude Opus durfte über Nacht laufen und produzierte 10 zunehmend bessere Iterationen des Sonnenblumen-Algorithmus. Diese reichten von grundlegender Ernte bis hin zu Mikrooptimierungen wie der Auswahl der nächstgelegenen Kachel und serpentinenartiger Navigation. In der finalen Iteration erreichte die KI eine Zeit von 5:21, übertraf damit offiziell die persönliche Bestzeit des Entwicklers und landete auf Platz 30 der globalen Bestenliste.
Das Experiment zeigte, dass eine KI, wenn sie mit Dokumentation und einer Sandbox zum Testen ihrer Ideen ausgestattet wird, den menschlichen Programmierer ersetzen kann – zumindest wenn es darum geht, Sonnenblumenerträge in diesem spezifischen Spielkontext zu optimieren.
Der während dieses Projekts erstellte Simulator steht anderen zur Verfügung, um ihn mit verschiedenen KI-Modellen zu nutzen und zu testen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Claude-Debugging-Fall: Agent scheiterte still, weil Parameter fehlten, die Formulierung war wichtiger als das Modell.
Ein Entwickler nutzte Claude, um einen Kalender-Agenten zu erstellen, und verbrachte dann 40 Minuten damit, dass Claude ihn debuggt, bevor er erkannte, dass dem write_calendar-Tool ein Teilnehmer-Parameter fehlte. Als der vollständige Kontext gegeben wurde, identifizierte Claude das Problem in 10 Sekunden.
Drei Geister: Ein Rahmenwerk für das Zusammenspiel von Mensch und zwei KI-Agenten
Ein Reddit-Nutzer beschreibt ein Muster der Mensch-KI-Zusammenarbeit mit zwei Claude-Agenten, die unterschiedliche Kontexte haben: einer für den täglichen Betrieb, einer für spezialisiertes Fachwissen. Der Mensch gibt die Richtung vor und trifft die endgültigen Entscheidungen.

Entwickler baut MCP-Server mit Claude Code, um Landsuche in Minnesota zu automatisieren
Ein Entwickler mit Hintergrund in Informationssicherheit und Automatisierungstechnik nutzte Claude Code, um einen Python/FastMCP-Server mit 7 Tools zu erstellen, der Zillow und LandWatch nach ländlichen Grundstücksangeboten in Minnesota durchsucht. Das System filtert Immobilien anhand von 10 Kriterien in 21 Landkreisen und fand in seinem ersten Durchlauf 29 einzigartige Grundstücke.

Browser-basiertes Curling-Spiel, erstellt mit Claude Sonnet 4.5 von einem Nicht-Programmierer
Ein Entwickler ohne Programmiererfahrung hat mit Claude Sonnet 4.5 ein vollständig spielbares Curling-Browserspiel erstellt. Das Spiel umfasst Physik, Punktestand und einen kompletten Spielablauf, wobei Claude die gesamte Codegenerierung, Fehlerbehebung und Verfeinerung basierend auf einfachem englischem Feedback übernahm.