Nelson v2.2.3 publiée : coordination multi-agents pour Claude Code, plus un benchmark de simulation à événements discrets

✍️ OpenClawRadar📅 Publié: May 9, 2026🔗 Source
Nelson v2.2.3 publiée : coordination multi-agents pour Claude Code, plus un benchmark de simulation à événements discrets
Ad

Nelson v2.2.3 est sorti — une compétence de coordination multi-agents pour Claude Code qui utilise une métaphore de la Royal Navy (amiral, capitaines, navires, équipage) pour empêcher les agents parallèles de marcher sur les plates-bandes des autres. Sous licence MIT, ~300 étoiles sur GitHub.

Installation

Exécutez ces commandes dans Claude Code :

/plugin marketplace add aspegio/nelson
/plugin install nelson@nelson
Utilise Nelson pour me construire un jeu de bataille navale.

Observez ensuite l'amiral, les capitaines et les navires se coordonner.

Ad

Résultats du benchmark

La véritable nouvelle est un benchmark construit par le même auteur. Il teste 13 combinaisons de modèle, CLI et compétence sur une tâche de simulation à événements discrets (débit synthétique d'une mine). Scores de qualité (sur 100) :

  • ouroboros-max-thinking (opus-4-7) : 97
  • plan-mode (opus-4-7) : 96
  • agent-teams-nelson-max-thinking (opus-4-7) : 95
  • superpowers-max-thinking (opus-4-7) : 94
  • max-thinking (opus-4-7) : 92
  • vanilla-max (sonnet-4-6) : 85
  • xhigh (gpt-5-5, codex) : 85
  • customtools (gemini-3.1-pro) : 81

Point clé : nelson a perdu face à ouroboros et plan-mode de 1 à 2 points mais a battu superpowers de 1 point, vanilla max-thinking de 3 points, et sonnet sans réflexion de 10 points. Plan-mode (sans compétences) a pris la deuxième place — les compétences sélectionnées n'ont pas creusé un écart important. Le modèle et l'activation de la réflexion ont compté bien plus que le choix de la compétence.

Limitations : n=1 tâche, qualité notée par rapport à une grille écrite par l'auteur de Nelson, pas encore de métrique combinée coût/précision.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Compétence OpenClaw 'Conseils d'Attente' Affiche des Astuces d'Apprentissage Pendant les Temps d'Attente des Réponses IA
Tools

Compétence OpenClaw 'Conseils d'Attente' Affiche des Astuces d'Apprentissage Pendant les Temps d'Attente des Réponses IA

La compétence 'Waiting Tips' pour OpenClaw envoie immédiatement un conseil d'apprentissage aléatoire lorsqu'un utilisateur envoie un message, comblant ainsi les 5 à 10 secondes d'attente des réponses IA avec du contenu utile. Elle comprend 75 conseils bilingues dans cinq catégories et fonctionne sur plusieurs plateformes de messagerie.

OpenClawRadar
Compilateur HEIR de Google : IA privée pratique avec chiffrement homomorphe
Tools

Compilateur HEIR de Google : IA privée pratique avec chiffrement homomorphe

Google open-source HEIR, un compilateur qui permet aux développeurs d'exécuter l'inférence IA sur des données chiffrées sans déchiffrement. Les démos incluent la détection de fraude, les recommandations, et plus.

OpenClawRadar
Agents IA de Pokemon Showdown construits avec des API LLM gratuites et appel d'outils
Tools

Agents IA de Pokemon Showdown construits avec des API LLM gratuites et appel d'outils

Un système qui utilise Llama 3, Qwen, Gemma via des niveaux d'API gratuits pour jouer de manière autonome à des combats Pokémon Showdown avec des appels d'outils structurés, prenant en charge les modes humain vs IA et IA vs IA.

OpenClawRadar
Elodin publie en open source un harnais de course IA avec simulation en temps réel de Betaflight pour les concurrents du Grand Prix IA
Tools

Elodin publie en open source un harnais de course IA avec simulation en temps réel de Betaflight pour les concurrents du Grand Prix IA

Elodin a publié un simulateur open-source pour le qualificatif virtuel de l'AI Grand Prix, respectant les contraintes de la compétition et fonctionnant avec le vrai Betaflight. L'outil basé sur Rust/Bevy génère des échantillons de capteur caméra directement dans la boucle, évitant ainsi les lourdeurs des moteurs de jeu.

OpenClawRadar