Nelson v2.2.3 Publicado: Coordinación Multiagente para Claude Code, más un Benchmark de Simulación de Eventos Discretos

Nelson v2.2.3 ya está disponible: una habilidad de coordinación multiagente para Claude Code que utiliza una metáfora de la Marina Real (almirante, capitanes, barcos, tripulación) para evitar que agentes paralelos interfieran entre sí. Licencia MIT, ~300 estrellas en GitHub.
Instalación
Ejecuta estos comandos dentro de Claude Code:
/plugin marketplace add aspegio/nelson
/plugin install nelson@nelson
Use Nelson para construirme un juego de hundir la flota.Luego observa cómo se coordinan almirante, capitanes y barcos.
Resultados del Benchmark
La novedad real es un benchmark creado por el mismo autor. Prueba 13 combinaciones de modelo, CLI y habilidad en una tarea de simulación de eventos discretos (rendimiento sintético de una mina). Puntuaciones de calidad (sobre 100):
- ouroboros-max-thinking (opus-4-7): 97
- plan-mode (opus-4-7): 96
- agent-teams-nelson-max-thinking (opus-4-7): 95
- superpowers-max-thinking (opus-4-7): 94
- max-thinking (opus-4-7): 92
- vanilla-max (sonnet-4-6): 85
- xhigh (gpt-5-5, codex): 85
- customtools (gemini-3.1-pro): 81
Conclusión clave: nelson perdió frente a ouroboros y plan-mode por 1–2 puntos, pero superó a superpowers por 1, a vanilla max-thinking por 3 y a sonnet sin razonamiento por 10. Plan-mode (sin habilidades) ocupó el segundo lugar: las habilidades seleccionadas no abrieron una gran brecha. El modelo y si el razonamiento está habilitado importaron mucho más que la elección de habilidad.
Salvedades: n=1 tarea, calidad evaluada según una rúbrica escrita por el autor de Nelson, aún no hay métrica combinada de costo/precisión.
📖 Lee la fuente original: r/ClaudeAI
👀 Ver también

Sistema de autoevaluación de 4 capas para la evolución conductual de OpenClaw
Un desarrollador creó un sistema de auditoría de 4 capas donde Gemini revisa semanalmente los puntos ciegos de Claude, detectando patrones que Claude pasó por alto en su autoevaluación. El sistema incluye verificación posterior a correcciones, minería de patrones, espejo externo y comparaciones entre expectativas y realidad.

Architect CLI: Herramienta de código abierto para orquestar agentes de IA sin interfaz en CI/CD
Architect es una herramienta CLI de código abierto diseñada para agentes de codificación autónomos en pipelines CI/CD, que incluye el Bucle Ralph para ciclos de prueba y reintento, barreras de protección deterministas, definiciones de pipelines en YAML y soporte para múltiples LLMs a través de LiteLLM.

CC-Ledger: Seguimiento de costos de Claude Code por sesión y por PR con SQLite local
CC-Ledger es un binario en Rust que se engancha a Claude Code, registrando cada turno en SQLite local. Detecta sesiones descontroladas en vivo y obtén el desglose de costos por PR sin necesidad de una clave API. Incluye barra de menú de macOS, panel web y CLI.

Aplicación gratuita para la barra de menús de macOS muestra estadísticas de uso de Claude en tiempo real mediante descifrado de cookies SQLite
Claude Usage Tracker es una aplicación gratuita para la barra de menú de macOS que lee las cookies cifradas de SQLite de la aplicación de escritorio de Claude, las descifra a través del Llavero y muestra el % de sesión, el límite semanal, el gasto y las ejecuciones rutinarias de forma local, sin necesidad de clave API.