Phalanx CLI coordena múltiplos agentes de IA para ciclos automatizados de revisão de código

CLI Multiagente para Revisão Automatizada de Código
Um desenvolvedor disponibilizou em código aberto o Phalanx, uma interface de linha de comando que coordena múltiplos agentes de IA de diferentes provedores para automatizar o ciclo de revisão e correção de código. A ferramenta atribui funções específicas a diferentes modelos: o Codex lida com a codificação real para velocidade e produtividade, o Claude Opus realiza a revisão de código para identificar problemas como condições de corrida e desvio de especificação, e um agente Claude Sonnet orquestra todo o processo.
Detalhes Principais da Implementação
Os usuários definem um arquivo de configuração de equipe que atribui modelos a funções específicas, então o Phalanx executa o loop de revisão automatizado. O desenvolvedor construiu a versão 2 do Phalanx usando o próprio Phalanx como um teste de estresse, observando vários desafios práticos:
- Agentes podem falhar no meio de uma tarefa devido a limites de contexto
- Tempos limite interrompem revisões longas
- A lógica de repetição adiciona complexidade significativa
- O loop de revisão funciona de forma autônoma uma vez que os agentes permanecem estáveis
Codebones: Ferramenta de Compressão de Repositório
Para resolver problemas de eficiência de tokens, o desenvolvedor criou o Codebones, uma ferramenta complementar que comprime repositórios em mapas estruturais. Em vez de incluir corpos completos de implementação, o Codebones gera:
- Estrutura da árvore de arquivos
- Assinaturas de funções
Isso permite que os agentes de IA compreendam a estrutura da base de código sem consumir tokens excessivos. Em testes, o Codebones comprimiu um repositório de 177.000 tokens para 30.000 tokens.
Custo e Limitações
Ambas as ferramentas funcionam com planos fixos de US$ 20/mês sem custos adicionais de API, em comparação com aproximadamente US$ 750/mês que o desenvolvedor gastava anteriormente no Cursor. Várias ressalvas importantes foram observadas:
- Limites de taxa de ambos os provedores de IA exigem agrupamento cuidadoso
- O escopo da tarefa é crítico — tarefas vagas produzem resultados ruins
- A abordagem é exagerada para correções pequenas
- Esta configuração funciona melhor para alterações substanciais de código
O desenvolvedor está explorando se outras pessoas estão coordenando múltiplos provedores de IA ou se a maioria dos desenvolvedores está se mantendo com soluções de provedor único.
Source Information
Ambas as ferramentas são de código aberto:
- Phalanx: github.com/creynir/phalanx
- Codebones: github.com/creynir/codebones
📖 Read the full source: r/ClaudeAI
👀 See Also

Jake Benchmark v1: Teste de Desempenho de LLM Local para Agentes de IA OpenClaw
Um desenvolvedor testou 7 LLMs locais como agentes de IA com o OpenClaw usando 22 tarefas práticas, incluindo processamento de e-mails, agendamento de reuniões e detecção de phishing. Os resultados variaram de 59,4% para o Qwen 27B a 1,6% para o Nemotron 30B, com registros detalhados das conversas disponíveis.

Atuin v18.13 adiciona comandos de shell com IA, um daemon de busca mais rápido e um proxy PTY.
A versão 18.13 do Atuin introduz três recursos principais: um assistente de inglês para Bash com IA chamado atuin ai, um daemon de busca mais rápido com indexação em memória, e um proxy PTY chamado hex que permite renderização de popups sem limpar a saída do terminal.
Estagiário de física da Hugging Face: Framework multiagente dobra Gemini no benchmark CritPt
Hugging Face lançou physics-intern, um framework multiagente para pesquisa em física teórica que dobra o desempenho dos modelos Gemini no benchmark CritPt e estabelece um novo SOTA em relação ao GPT-5.5 Pro com custo mais baixo.
Zillow-Full: Uma Habilidade do OpenClaw Que Transformou a Pesquisa Manual de Imóveis em um Pipeline Automatizado de Negócios
Um desenvolvedor criou 'zillow-full' no OpenClaw para obter Zestimates, histórico de impostos, histórico de preços e comparáveis por propriedade. Com um cron noturno classificando listagens com base em critérios de negócio, os negócios de atacado saltaram de 2 para 11 por mês.