Bom Desenvolvimento Assistido por IA Acontece no Nível de Sistemas, Não no Nível de Tarefas

Um post no Reddit do usuário u/johns10davenport argumenta que a verdadeira alavancagem no desenvolvimento assistido por IA vem de mudar o sistema, não de melhorar os prompts. O autor relata uma frustração comum: toda vez que adiciona um novo recurso ao seu aplicativo Phoenix, o agente de codificação de IA entrega o recurso, mas omite o item de menu. A página existe, a funcionalidade funciona, mas não há como o usuário chegar lá.
O Problema da Correção no Nível da Tarefa
O primeiro instinto é dizer ao modelo: "adicione o botão". Isso funciona, mas o humano ainda está pensando — diagnosticando o problema e prescrevendo a solução. O autor chama isso de "pedalar o Peloton para que a Anthropic me dê tokens grátis". Engenharia de prompt só faz você melhor em dizer ao modelo o que fazer, mas você ainda está trabalhando para o modelo.
A Mudança no Nível do Sistema
Em vez de corrigir o botão ausente, o autor perguntou: como tornar esse erro impossível no futuro? A solução deles usa especificações BDD e auxiliares de teste do Phoenix LiveView. A função navigate do framework de teste permite que o agente pule diretamente para qualquer página, passando nos testes sem nunca tocar na interface. Então eles escreveram uma regra de linter que impede o agente de chamar navigate. Agora existe uma fixture permitida que coloca o teste em uma rota inicial conhecida, e a única maneira do agente alcançar o novo recurso é clicando pela interface — o que o força a adicionar o item de menu para fazer o teste passar.
O resultado: o problema nunca mais ocorrerá, não por causa de um prompt melhor, mas porque o comportamento correto é o único comportamento possível.
Conclusão Principal
Pare de corrigir a saída do modelo. Comece a restringir o ambiente dele para que a saída correta seja o caminho de menor resistência. Cada erro é uma oportunidade de projetar para eliminar o próximo.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

OpenClaw WhatsApp Auto-Resposta Pode Ignorar Compreensão de Mídia na Versão 2026.4.2
Um usuário relata que o fluxo de resposta automática do WhatsApp do OpenClaw 2026.4.2 pode pular o pipeline de compreensão de mídia, impedindo a transcrição de notas de voz ao usar backends de STT externos como o Groq. A correção envolve chamar explicitamente a compreensão de mídia antes do despacho do agente.

Inchaço de tokens em frameworks de agentes: uma relação de entrada-saída de 500:1 é normal
Um usuário de um framework de agente auto-hospedado relata ~21k tokens de entrada por mensagem e uma proporção de 500:1 entre entrada e saída, provenientes de definições de ferramentas, prompt do sistema e memória. A comunidade confirma que 15-25k de contexto base é comum para agentes que usam ferramentas.

Executando MiniMax M2.7 Q8_0 128K em 2x3090 com Offloading de CPU – Benchmarks e Configurações do Mundo Real
Um usuário executa com sucesso o MiniMax M2.7 em Q8_0 com 128K de contexto em duas RTX 3090 mais RAM DDR4, alcançando ~50 tps no processamento de prompt e ~10 tps na geração de tokens, e compartilha suas flags do llama-server.

Gerenciando o Consumo de Tokens do Claude AI: Dicas Práticas da Experiência de Desenvolvedores
Um desenvolvedor relata ter consumido 94.000 tokens em 3 minutos usando o recurso Explore do Claude, resultando em limitação de taxa por 4 horas, e compartilha estratégias concretas incluindo manter um arquivo ARCHITECTURE.md e usar prompts cirúrgicos para controlar o uso de tokens.