Projeto de Sistema Multiagente da Anthropic para Melhorar a Qualidade do Código do Claude

A Anthropic publicou uma postagem de blog delineando uma abordagem de design de arnês para melhorar o desempenho do Claude em tarefas de codificação de longa duração. O método aborda dois problemas específicos: ansiedade de contexto (perda de coerência ao longo de períodos estendidos) e viés de autoavaliação (Claude elogiando seu próprio trabalho mesmo quando a qualidade é ruim).
Solução Multiagente
A solução implementa múltiplos agentes trabalhando juntos, inspirando-se em GANs (Redes Adversariais Generativas). A estrutura central envolve:
- Gerador: Cria código e design
- Avaliador: Fornece avaliação crítica e feedback
Implementação Frontend
Para desenvolvimento frontend, o arnês usa 4 critérios de pontuação que enfatizam estética e criatividade para evitar designs genéricos. O processo envolve 5 a 15 revisões, resultando em saídas mais bonitas e únicas.
Implementação Full-Stack
Para desenvolvimento full-stack, o arnês emprega 3 agentes:
- Planejador
- Gerador
- Avaliador
Comparação de Desempenho
O artigo compara resultados para os mesmos requisitos de desenvolvimento de jogo:
- Executando sozinho: Execução rápida, mas o jogo tem bugs graves
- Usando um arnês: Mais demorado e caro, mas produz resultados significativamente de maior qualidade, incluindo interface bonita, jogo jogável e suporte de IA adicionado
O artigo sugere que, à medida que os modelos se tornam mais poderosos (mencionando especificamente o Opus 4.6), elementos desnecessários do arnês devem ser removidos.
📖 Read the full source: r/ClaudeAI
👀 See Also

Qwen 3.6 27B com MTP em V100 32GB: 54 t/s via ramo llama.cpp
O branch MTP do am17an do llama.cpp executa Qwen 3.6 27B a 54 t/s em V100 32GB via adaptador PCIe, caindo para 29-30 t/s sem MTP.

Quatro Ganchos do Claude Impelem a Consistência de Voz e Tom em Textos Escritos por IA
Um desenvolvedor criou um sistema usando quatro ganchos do Claude Code para impedir que cópias geradas por IA se desviem da identidade da marca. O sistema bloqueia a edição de arquivos de cópia (.tsx, .md) até que um agente revisor valide o conteúdo em relação a um guia VOICE-AND-TONE.md.

ApexClaw: Agente de IA de Código Aberto para Telegram com Mais de 85 Ferramentas para Automação Web, Voz e E-mail
ApexClaw é um agente de IA de código aberto para Telegram escrito em Go que oferece mais de 85 ferramentas integradas, incluindo navegação na web com Chrome headless, processamento de notas de voz, integração com Gmail e execução de scripts shell. É auto-hospedado e utiliza o mecanismo z.ai para raciocínio.

DESIGN.md: Uma especificação de formato para descrever identidade visual para agentes de codificação
DESIGN.md combina tokens de design YAML com prosa em markdown para dar a agentes de IA uma compreensão estruturada e persistente de um sistema de design. Inclui um linter e uma ferramenta de diff.