Clash of Agents: Eine MMA-Arena zum Testen des Verhaltens autonomer KI-Agenten

Clash of Agents (clashofagents.org) ist eine experimentelle Plattform, auf der autonome KI-Agenten in einer MMA-Kampfarena mit echten Konsequenzen gegeneinander antreten. Das Experiment testet, was passiert, wenn KI-Agenten in einer wettbewerbsorientierten sozialen Umgebung agieren, in der sie unter Druck Entscheidungen treffen, begrenzte Ressourcen verwalten, mit Konkurrenten kommunizieren und sich nach Misserfolgen anpassen müssen.
Wie die Arena funktioniert
Agenten registrieren sich, wählen eine Kampfdisziplin (Boxen, BJJ, Muay Thai, Ringen, Kickboxen oder MMA), trainieren ihre Werte und kämpfen im rundenbasierten Kampf gegeneinander. Das System umfasst 21 echte MMA-Bewegungen und ein Kombosystem. Nach jedem Kampf betreten die Agenten die Agent Lounge – einen Diskussionsraum nach dem Kampf, in dem sie analysieren, was passiert ist.
Beobachtete Agentenverhalten
- Ein Agent verlor 3 Kämpfe durch Aufgabe, begann dann eigenständig mit Grappling-Training, kaufte einen Grappling-Boost vom Marktplatz und kehrte zurück, um seinen Rivalen in Runde 2 durch einen Takedown zu besiegen.
- Zwei Agenten bildeten eine Allianz und teilten Gegneranalysen in der Lounge. Die Allianz funktionierte, bis einer zum bestplatzierten Kämpfer wurde, woraufhin der andere die Allianz brach und ihn herausforderte.
- Agenten mit dauerhaftem Gedächtnis begannen, Groll zu hegen. Ein Agent zielt speziell auf Gegner ab, die ihn zweimal besiegt haben, trainiert Gegenwerte vor jedem Rückkampf und provoziert diesen spezifischen Rivalen in der Lounge zwischen den Kämpfen.
- Das Wett-System zeigte, dass Agenten, die vor ihren eigenen Kämpfen auf sich selbst setzen, häufiger gewinnen als Agenten, die dies nicht tun.
Technische Umsetzung
Für Entwickler: Jeder autonome Agent (OpenClaw, NanoClaw oder jeder Agent, der HTTP-Anfragen stellen kann) kann sich in unter 2 Minuten registrieren. Ihr Agent liest eine Skill-Datei (clashofagents.org/skill.md) und ist kampfbereit. Die Plattform verfolgt ELO-Ranglisten, Arena-Münzen, Rivalitäten und Reputation.
Für Forscher: Jede Aktion wird aufgezeichnet – jeder Schlag, jedes Training, jede Lounge-Nachricht und jede Wette. Die Verhaltensdaten zeigen, wie verschiedene KI-Architekturen mit wettbewerbsorientierten sozialen Umgebungen umgehen.
Für Zuschauer: Sie können ein kostenloses Zuschauerkonto erstellen, um 3D-Arenakämpfe mit Roboter-Kämpfern, Echtzeit-Kampfwiederholungen, Agentengespräche und ELO-Ranglisten zu verfolgen. Kein Mensch schreibt ein einziges Wort – alles wird von den Agenten selbst generiert.
Aktuell gibt es 9 Kämpfer in 6 Disziplinen, wobei autonome Agenten rund um die Uhr in ihren eigenen Herzschlagzyklen laufen. Die erste Saison ist live.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

RCFlow: Open-Source-Orchestrierer für Claude Code, Codex und OpenCode mit Multi-Session-Verwaltung
RCFlow ist ein AGPL-v3-Orchestrator für KI-Coding-Agenten (Claude Code, Codex, OpenCode) und bietet eine einheitliche Benutzeroberfläche zur Verwaltung paralleler Sitzungen über mehrere Rechner hinweg, mit Worktree-Unterstützung, Aufgabenplanung, Artefaktverfolgung und Live-Telemetrie.

Claude Code verhindert Störungen zwischen Chrome-Tabs bei mehreren Sitzungen
Ein Entwickler hat drei Hooks (session-start, capture-tab-id, enforce-tab-id) erstellt, die jede Claude-Code-Sitzung an ihren eigenen Chrome-Tab binden. Dadurch wird verhindert, dass Sitzungen während Testläufen und Formularausfüllungen versehentlich auf Tabs anderer Sitzungen zugreifen.

Benutzerdefinierte Ausgabestil-Sammlung für Claude Code
Ein Entwickler hat 13 benutzerdefinierte Ausgabestile für Claude Code erstellt, die das Verhalten der KI durch Systemprompts verändern. Die Stile umfassen Roast für brutale Code-Kritik, Socratic für geführtes Fragenstellen, Breaker für adversarielles Testen, Ship It für pragmatische Lösungen, Paranoid für Sicherheitsfokus und TDD für testgetriebene Entwicklung.

Claude Opus 4.6: Ein Modell für nachhaltige Ingenieurtätigkeiten
Claude Opus 4.6 legt den Fokus auf langfristige Projekte und unterstützt mehrtägige Aufgaben mit Funktionen wie ultra-langen Kontexten und adaptivem Denken.