AGENTS.md Feito Corretamente: Um Aumento de 25% na Precisão — ou uma Queda de 30%

A Augment Code realizou um estudo sistemático sobre arquivos AGENTS.md em seu monorepo. Os melhores arquivos deram ao seu agente de codificação um salto de qualidade equivalente a atualizar de Haiku para Opus; os piores tornaram a saída pior do que não ter nenhum AGENTS.md. O mesmo arquivo aumentou best_practices em 25% em uma correção de bug rotineira e reduziu completeness em 30% em uma tarefa complexa de funcionalidade no mesmo módulo. Veja o que funciona.
Como Eles Mediram
Eles usaram o AuggieBench, um conjunto de avaliação interno. Começaram com PRs de alta qualidade de um repositório grande que refletem tarefas típicas do dia a dia do agente, configuraram o ambiente e o prompt, e pediram ao agente para reproduzir o PR. Compararam a saída com o PR dourado (a versão que foi aprovada após revisão por vários engenheiros seniores). Os PRs tinham que estar contidos em um único módulo ou aplicativo, e o escopo precisava ser algo onde um AGENTS.md pudesse plausivelmente ajudar. Cada tarefa foi executada duas vezes — com e sem o arquivo.
O Que Funciona
1. Divulgação Progressiva > Cobertura Abrangente
Cubra casos comuns e fluxos de trabalho em alto nível; empurre detalhes para arquivos de referência que o agente pode carregar sob demanda. Mantenha o escopo de cada referência claro. Arquivos de 100 a 150 linhas com alguns documentos de referência focados proporcionaram melhorias de 10 a 15% nas métricas em módulos de médio porte (~100 arquivos principais). Acima desse comprimento, os ganhos se reverteram.
2. Fluxos de Trabalho Procedurais
Um fluxo de trabalho numerado de várias etapas pode fazer o agente passar de falha para conclusão. Exemplo: um fluxo de trabalho de seis etapas para implantar uma nova integração. Arquivos de conexão ausentes caíram de 40% para 10%, o agente terminou mais rápido, a correção aumentou 25%, a completeza aumentou 20%. Mantenha o arquivo principal conciso e use arquivos de referência para casos de ramificação.
3. Tabelas de Decisão
Quando duas ou três maneiras razoáveis existem (por exemplo, React Query vs Zustand para gerenciamento de estado), force a escolha antecipadamente com uma tabela. Exemplo:
Pergunta → React Query → Zustand
O servidor é a única fonte de dados? ✅
Múltiplos caminhos de código alteram esse estado? ✅
Precisa de atualizações otimistas misturadas com estado local? ✅
PRs nessa área pontuaram 25% mais alto em best_practices.
4. Exemplos Curtos de Produção
Snippets de 3 a 10 linhas do código de produção real melhoraram a reutilização e a adesão a padrões. Exemplo: modelos de copiar-colar para primitivas do Redux Toolkit (createSlice com estado inicial tipado, createAsyncThunk com tratamento de erros, useAppSelector tipado). code_reuse subiu 20%.
5. Regras Específicas de Domínio
Ainda importam — o padrão que a maioria das pessoas já associa ao AGENTS.md.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Executando OpenClaw, ClawdBot e MoltBot com Orçamento Limitado
Descubra como executar OpenClaw, ClawdBot e MoltBot sem gastar muito. Explore dicas de orçamento e alternativas gratuitas, conforme discutido por entusiastas no r/clawdbot.

Camoufox Injeção de Cookie: Navegue no Reddit como Você Enquanto Seu Agente Faz o Trabalho
Um guia detalhado sobre como contornar a detecção de bots do Reddit extraindo cookies do Firefox e injetando-os no Camoufox via Playwright.

Corrigindo Problemas de Autonomia do Agente OpenClaw: Arquivos de Habilidades, Seleção de Ferramentas e Configuração do Cron
Um desenvolvedor compartilha soluções para agentes OpenClaw que param de funcionar autonomamente após a configuração inicial. As principais correções incluem usar arquivos de habilidades externos em vez de instruções de chat, substituir ferramentas de navegador por ferramentas baseadas em API ou scripts Puppeteer, e configurar corretamente os trabalhos cron.

Técnicas práticas para reduzir a derivação de estado em agentes de IA de múltiplas etapas
Um desenvolvedor compartilha métodos concretos para corrigir a deriva de estado em fluxos de trabalho multiagente, incluindo leituras baseadas em snapshot, gravações apenas de acréscimo e separação de estado do contexto. Essas abordagens tornaram as execuções reproduzíveis e a depuração rastreável.