Comparando Sistemas de IA Multiagente: Harness de Anthropic vs. el Modelo de Organización de Ingeniería de Agyn

✍️ OpenClawRadar📅 Publicado: 31 de marzo de 2026🔗 Source
Comparando Sistemas de IA Multiagente: Harness de Anthropic vs. el Modelo de Organización de Ingeniería de Agyn
Ad

Anthropic ha publicado un diseño de arnés para el desarrollo de aplicaciones de larga duración, mientras que el sistema multiagente de Agyn para la ingeniería de software autónoma basada en equipos se publicó como código abierto el mes pasado en arXiv. Ambos enfoques rechazan el modelo de "agente monolítico" y en su lugar estructuran a los agentes de IA para que trabajen como equipos de ingeniería reales con separación de roles, transferencias estructuradas y bucles de revisión.

Diferencias en la arquitectura central

El sistema de Anthropic utiliza una arquitectura inspirada en GAN con tres roles: planificador → generador → evaluador. El evaluador utiliza Playwright para interactuar con la aplicación en ejecución como un usuario real, luego proporciona una crítica estructurada al generador.

Agyn modela el proceso como una organización de ingeniería con cuatro roles: coordinación → investigación → implementación → revisión. Los agentes operan en entornos aislados y se comunican a través de contratos definidos.

Soluciones compartidas a problemas comunes

  • Los modelos pierden coherencia en tareas largas: Anthropic utiliza reinicios de contexto con artefactos de transferencia estructurada, mientras que Agyn utiliza compactación con transferencias estructuradas entre roles
  • La autoevaluación es demasiado indulgente: Ambos sistemas separan la evaluación de la generación. Anthropic utiliza un agente evaluador separado calibrado con ejemplos de pocas muestras, mientras que Agyn tiene un rol de revisión dedicado separado de la implementación
  • Criterios de "finalización" ambiguos: Anthropic utiliza contratos de sprint negociados antes de comenzar el trabajo, mientras que Agyn tiene una fase de especificación de tareas con criterios de aceptación explícitos y pruebas requeridas
  • Descomposición compleja de tareas: El planificador de Anthropic expande indicaciones de una oración en especificaciones completas, mientras que el agente investigador de Agyn descompone problemas y produce especificaciones antes de que comience la implementación
  • Ansiedad por el contexto: Anthropic utiliza reinicios para comenzar desde cero, mientras que Agyn utiliza compactación con una capa de memoria
Ad

Características distintivas de Agyn

Agyn incluye dos características no presentes en el arnés de Anthropic:

  • Entornos aislados por agente: Cada agente opera en su propio espacio de archivos y red aislado, evitando colisiones en el estado compartido durante el trabajo paralelo o secuencial
  • GitHub como estado compartido: El sistema utiliza primitivas de GitHub (commits, comentarios, PRs, revisiones) que los equipos humanos ya entienden, proporcionando un registro de auditoría completo sin requerir protocolos de comunicación personalizados

Diferencias de implementación

El arnés de Anthropic está construido estrechamente alrededor de Claude utilizando el Claude Agent SDK y Playwright MCP para el bucle de evaluación. El evaluador navega por aplicaciones en ejecución antes de puntuar.

Agyn es independiente del modelo por diseño, compatible con Claude, Codex y modelos de peso abierto. El sistema permite mezclar diferentes modelos por rol, lo que en la práctica ha demostrado superar el uso de un solo modelo para todo.

📖 Read the full source: r/ClaudeAI

Ad

👀 Ver también

HolyCode: Contenedor Docker para Entornos de Codificación Persistentes de Claude AI
Herramientas

HolyCode: Contenedor Docker para Entornos de Codificación Persistentes de Claude AI

HolyCode es un contenedor Docker que mantiene el estado del entorno de programación con IA al cambiar de máquina o reconstruirlo. Incluye más de 30 herramientas preinstaladas, automatización del navegador con Chromium + xvfb + Playwright, y conserva el contexto en ./data/opencode.

OpenClawRadar
Comparación de 14 Variantes del Agente de IA Claw en 10 Categorías
Herramientas

Comparación de 14 Variantes del Agente de IA Claw en 10 Categorías

Una comparación detallada de 14 variantes populares de agentes de IA Claw, incluyendo OpenClaw, NanoClaw, NemoClaw, ZeroClaw, PicoClaw, Moltis, IronClaw y NullClaw, evaluadas a través de 53 subparámetros con clasificaciones compuestas y casos de uso ideales para cada una.

OpenClawRadar
Ingeniero de Audio Construye Herramienta de Análisis de Mezclas con Claude Code
Herramientas

Ingeniero de Audio Construye Herramienta de Análisis de Mezclas con Claude Code

Un ingeniero de audio creó una herramienta que analiza mezclas de audio utilizando la Web Audio API y Claude para proporcionar retroalimentación específica sobre problemas como graves-medios turbios, falta de margen dinámico y vocales enterradas. La herramienta ofrece un nivel gratuito para análisis rápido y un informe profesional de pago con notas detalladas de frecuencia y sugerencias de plugins.

OpenClawRadar
Tu Herramienta de Participación Justa: Calcula Tu Parte Equitativa de las Ganancias de la Empresa
Herramientas

Tu Herramienta de Participación Justa: Calcula Tu Parte Equitativa de las Ganancias de la Empresa

Un desarrollador creó una herramienta web utilizando Claude Code y Vercel que calcula cuál sería tu parte equitativa de las ganancias anuales de tu empleador basándose en los informes SEC 10-K. La herramienta muestra cifras específicas como los $747,000 por empleado de Apple y los $2.8 millones por empleado de NVIDIA.

OpenClawRadar