Nelson v2.2.3 veröffentlicht: Multi-Agent-Koordination für Claude Code, plus ein Benchmark für diskrete Ereignissimulation

Nelson v2.2.3 ist da – eine Multi-Agenten-Koordinationsfähigkeit für Claude Code, die eine Metapher der Royal Navy (Admiral, Kapitäne, Schiffe, Crew) verwendet, um parallele Agenten davon abzuhalten, sich gegenseitig ins Handwerk zu pfuschen. MIT-lizenziert, ~300 Sterne auf GitHub.
Installation
Führen Sie diese Befehle in Claude Code aus:
/plugin marketplace add aspegio/nelson
/plugin install nelson@nelson
Verwende Nelson, um mir ein Schiffeversenken-Spiel zu bauen.Beobachten Sie dann, wie Admiral, Kapitäne und Schiffe koordinieren.
Benchmark-Ergebnisse
Die eigentliche Neuigkeit ist ein Benchmark, der vom gleichen Autor erstellt wurde. Er testet 13 Kombinationen aus Modell, CLI und Fähigkeit bei einer diskreten Ereignissimulation (synthetischer Minendurchsatz). Qualitätsbewertungen (von 100):
- ouroboros-max-thinking (opus-4-7): 97
- plan-mode (opus-4-7): 96
- agent-teams-nelson-max-thinking (opus-4-7): 95
- superpowers-max-thinking (opus-4-7): 94
- max-thinking (opus-4-7): 92
- vanilla-max (sonnet-4-6): 85
- xhigh (gpt-5-5, codex): 85
- customtools (gemini-3.1-pro): 81
Wichtigste Erkenntnis: Nelson verlor gegen ouroboros und plan-mode um 1–2 Punkte, schlug aber superpowers um 1, vanilla max-thinking um 3 und sonnet ohne Denkmodus um 10 Punkte. Plan-mode (ohne Fähigkeiten) belegte den zweiten Platz – kuratierte Fähigkeiten erzielten keinen großen Vorsprung. Das Modell und die Aktivierung des Denkmodus waren weitaus wichtiger als die Wahl der Fähigkeit.
Einschränkungen: n=1 Aufgabe, Qualitätsbewertung anhand eines Rubrik des Autors von Nelson, noch keine kombinierte Kosten/Genauigkeits-Metrik.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

No-Code Persistent Memory System für Claude mit Notion und MCP
Ein Radiologe hat in Notion einen 'Cognitive Hub' aufgebaut, den Claude über MCP liest und beschreibt, wodurch eine strukturierte Wissensdatenbank mit einer Routing-Tabelle entsteht, um nur relevante Informationen pro Konversation zu laden. Das System ist nach einem Monat täglicher Nutzung auf über 70 Seiten angewachsen.

Wisepanel MCP Server ermöglicht Multi-LLM-Deliberation in Claude Code und Cursor
Wisepanel hat einen MCP-Server veröffentlicht, der Multi-Agent-Deliberationen direkt aus Claude Code, Cursor oder jedem MCP-Client ausführt und dabei ein divergentes Kontexterweiterungssystem mit ChatGPT-, Claude-, Gemini- und Perplexity-Modellen nutzt.

Claude AI-Sitzungskomprimierungsprobleme und Workarounds
Die Standardkomprimierung in Claude AI-Sitzungen kann die Abrufgenauigkeit von ~9,75/10 auf ~5/10 verschlechtern, was zu Halluzinationen führt. Der Benutzer testete mit 418.000 Tokens und stellte fest, dass manuelle Komprimierung mit Opus die Genauigkeit beibehält, während die Standardkomprimierung versagt.

Gemini 3.1 Pro in Multi-Agenten-Systemen: Hohe Designqualität, 20% Fehlerrate bei Tool-Aufrufen
Entwickler, die Bobr, einen KI-Präsentationsgenerator mit einer Multi-Agenten-Architektur erstellen, berichten, dass Gemini 3.1 Pro beeindruckende Design-Ergebnisse liefert, aber unter einer Ausfallrate von Werkzeugaufrufen von ~20 % und verstümmelter Textkorruption in Produktions-Pipelines leidet.