Comparando Sistemas de IA Multiagente: Harness da Anthropic vs Modelo de Engenharia Organizacional da Agyn

A Anthropic publicou um design de estrutura para desenvolvimento de aplicações de longa duração, enquanto o sistema multiagente Agyn para engenharia de software autônoma baseada em equipe foi disponibilizado em código aberto no mês passado no arXiv. Ambas as abordagens rejeitam o modelo de "agente monolítico" e, em vez disso, estruturam os agentes de IA para trabalharem como equipes de engenharia reais, com separação de papéis, transferências estruturadas e ciclos de revisão.
Diferenças Principais na Arquitetura
O sistema da Anthropic usa uma arquitetura inspirada em GAN com três papéis: planejador → gerador → avaliador. O avaliador usa Playwright para interagir com a aplicação em execução como um usuário real, fornecendo então uma crítica estruturada de volta ao gerador.
O Agyn modela o processo como uma organização de engenharia com quatro papéis: coordenação → pesquisa → implementação → revisão. Os agentes operam em sandboxes isoladas e se comunicam através de contratos definidos.
Soluções Compartilhadas para Problemas Comuns
- Modelos perdendo coerência em tarefas longas: A Anthropic usa reinicializações de contexto com artefatos de transferência estruturada, enquanto o Agyn usa compactação com transferências estruturadas entre papéis
- A autoavaliação sendo muito branda: Ambos os sistemas separam avaliação de geração. A Anthropic usa um agente avaliador separado calibrado em exemplos few-shot, enquanto o Agyn tem um papel de revisão dedicado separado da implementação
- Critérios de "concluído" ambíguos: A Anthropic usa contratos de sprint negociados antes do início do trabalho, enquanto o Agyn tem uma fase de especificação de tarefas com critérios de aceitação explícitos e testes obrigatórios
- Decomposição complexa de tarefas: O planejador da Anthropic expande prompts de uma frase em especificações completas, enquanto o agente pesquisador do Agyn decompõe problemas e produz especificações antes do início da implementação
- Ansiedade de contexto: A Anthropic usa reinicializações para começar do zero, enquanto o Agyn usa compactação com uma camada de memória
Características Distintivas do Agyn
O Agyn inclui duas características não presentes na estrutura da Anthropic:
- Sandboxes isoladas por agente: Cada agente opera em seu próprio namespace isolado de arquivos e rede, prevenindo colisões em estado compartilhado durante trabalhos paralelos ou sequenciais
- GitHub como estado compartilhado: O sistema usa primitivas do GitHub (commits, comentários, PRs, revisões) que equipes humanas já entendem, fornecendo um log de auditoria completo sem exigir protocolos de comunicação personalizados
Diferenças de Implementação
A estrutura da Anthropic é construída firmemente em torno do Claude usando o Claude Agent SDK e Playwright MCP para o ciclo de avaliação. O avaliador navega em aplicações em execução ao vivo antes de pontuar.
O Agyn é por design agnóstico de modelo, suportando Claude, Codex e modelos de peso aberto. O sistema permite misturar diferentes modelos por papel, o que na prática tem se mostrado superior a usar um único modelo para tudo.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Extraí a memória markdown padrão do OpenClaw e construí uma camada de API Node.js/Postgres em vez disso
Um desenvolvedor desativou o plugin de memória principal do OpenClaw e construiu um backend tipado com Node.js/Express + PostgreSQL. O desvio de contexto caiu a zero.

Sistema de 7 Agentes no Claude Code Substitui Cerimônias de Sprint para Desenvolvedores Solo
Um ex-PM que virou dev solo construiu uma equipe de 7 agentes dentro do Claude Code que cuida de QA, revisão de PR, segurança, arquitetura e backlog — tudo acionado por um único comando /review.

Baton: Um Aplicativo de Desktop para Gerenciar Múltiplos Agentes de IA de Programação
Baton é um aplicativo de desktop que ajuda desenvolvedores a gerenciar múltiplos agentes de IA para codificação em workspaces isolados. Ele fornece sessões de terminal em tempo real, isolamento de worktree git e monitoramento de status para agentes como Claude Code, Codex CLI, OpenCode e Gemini CLI.

GoModel: Um Gateway de IA Leve e de Código Aberto Escrito em Go
GoModel é um gateway de IA de código aberto que fornece uma API unificada compatível com OpenAI para vários provedores, incluindo OpenAI, Anthropic, Gemini, Groq, xAI e Ollama. Ele apresenta uma imagem Docker de 17MB, 44x menor que a LiteLLM, com configuração priorizando variáveis de ambiente e observabilidade integrada.