Nelson v2.2.3 publiée : coordination multi-agents pour Claude Code, plus un benchmark de simulation à événements discrets

✍️ OpenClawRadar📅 Publié: May 9, 2026🔗 Source
Nelson v2.2.3 publiée : coordination multi-agents pour Claude Code, plus un benchmark de simulation à événements discrets
Ad

Nelson v2.2.3 est sorti — une compétence de coordination multi-agents pour Claude Code qui utilise une métaphore de la Royal Navy (amiral, capitaines, navires, équipage) pour empêcher les agents parallèles de marcher sur les plates-bandes des autres. Sous licence MIT, ~300 étoiles sur GitHub.

Installation

Exécutez ces commandes dans Claude Code :

/plugin marketplace add aspegio/nelson
/plugin install nelson@nelson
Utilise Nelson pour me construire un jeu de bataille navale.

Observez ensuite l'amiral, les capitaines et les navires se coordonner.

Ad

Résultats du benchmark

La véritable nouvelle est un benchmark construit par le même auteur. Il teste 13 combinaisons de modèle, CLI et compétence sur une tâche de simulation à événements discrets (débit synthétique d'une mine). Scores de qualité (sur 100) :

  • ouroboros-max-thinking (opus-4-7) : 97
  • plan-mode (opus-4-7) : 96
  • agent-teams-nelson-max-thinking (opus-4-7) : 95
  • superpowers-max-thinking (opus-4-7) : 94
  • max-thinking (opus-4-7) : 92
  • vanilla-max (sonnet-4-6) : 85
  • xhigh (gpt-5-5, codex) : 85
  • customtools (gemini-3.1-pro) : 81

Point clé : nelson a perdu face à ouroboros et plan-mode de 1 à 2 points mais a battu superpowers de 1 point, vanilla max-thinking de 3 points, et sonnet sans réflexion de 10 points. Plan-mode (sans compétences) a pris la deuxième place — les compétences sélectionnées n'ont pas creusé un écart important. Le modèle et l'activation de la réflexion ont compté bien plus que le choix de la compétence.

Limitations : n=1 tâche, qualité notée par rapport à une grille écrite par l'auteur de Nelson, pas encore de métrique combinée coût/précision.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

GuppyLM : Un LLM de 9M paramètres construit à partir de zéro à des fins éducatives
Tools

GuppyLM : Un LLM de 9M paramètres construit à partir de zéro à des fins éducatives

GuppyLM est un modèle de langage d'environ 9 millions de paramètres entraîné à partir de zéro sur 60 000 conversations synthétiques, utilisant une architecture de transformateur classique avec 6 couches, 384 dimensions cachées et 6 têtes d'attention. Il s'entraîne en environ 5 minutes sur un GPU T4 Colab gratuit et parle avec une personnalité de poisson axée sur l'eau, la nourriture et la vie en aquarium.

OpenClawRadar
ClawMetry ajoute une surveillance à distance avec chiffrement de bout en bout pour les agents OpenClaw
Tools

ClawMetry ajoute une surveillance à distance avec chiffrement de bout en bout pour les agents OpenClaw

ClawMetry v0.1.0 inclut désormais la synchronisation cloud pour la surveillance à distance des agents OpenClaw depuis n'importe quel navigateur ou application de la barre de menus Mac, avec un chiffrement de bout en bout qui maintient les données chiffrées jusqu'à ce qu'elles atteignent votre client.

OpenClawRadar
AgenticStore MCP : Boîte à outils Python pour Claude Desktop avec 27 outils locaux
Tools

AgenticStore MCP : Boîte à outils Python pour Claude Desktop avec 27 outils locaux

AgenticStore MCP est une boîte à outils Python open-source qui remplace plusieurs serveurs MCP par une seule installation, offrant à Claude Desktop 27 outils locaux incluant une mémoire persistante, une recherche web et un audit de dépôt, sans nécessiter de configuration Docker ou Node.js.

OpenClawRadar
Plugin Claude Code /verify : Tests de navigateur automatisés depuis votre plan
Tools

Plugin Claude Code /verify : Tests de navigateur automatisés depuis votre plan

/verify est un plugin open source pour Claude Code qui lit votre plan, lance un vrai navigateur via Playwright MCP, vérifie chaque exigence et vous fournit un rapport succès/échec avec des captures d'écran.

OpenClawRadar