Bom Desenvolvimento Assistido por IA Acontece no Nível de Sistemas, Não no Nível de Tarefas

✍️ OpenClawRadar📅 Publicado: May 20, 2026🔗 Source
Bom Desenvolvimento Assistido por IA Acontece no Nível de Sistemas, Não no Nível de Tarefas
Ad

Um post no Reddit do usuário u/johns10davenport argumenta que a verdadeira alavancagem no desenvolvimento assistido por IA vem de mudar o sistema, não de melhorar os prompts. O autor relata uma frustração comum: toda vez que adiciona um novo recurso ao seu aplicativo Phoenix, o agente de codificação de IA entrega o recurso, mas omite o item de menu. A página existe, a funcionalidade funciona, mas não há como o usuário chegar lá.

O Problema da Correção no Nível da Tarefa

O primeiro instinto é dizer ao modelo: "adicione o botão". Isso funciona, mas o humano ainda está pensando — diagnosticando o problema e prescrevendo a solução. O autor chama isso de "pedalar o Peloton para que a Anthropic me dê tokens grátis". Engenharia de prompt só faz você melhor em dizer ao modelo o que fazer, mas você ainda está trabalhando para o modelo.

Ad

A Mudança no Nível do Sistema

Em vez de corrigir o botão ausente, o autor perguntou: como tornar esse erro impossível no futuro? A solução deles usa especificações BDD e auxiliares de teste do Phoenix LiveView. A função navigate do framework de teste permite que o agente pule diretamente para qualquer página, passando nos testes sem nunca tocar na interface. Então eles escreveram uma regra de linter que impede o agente de chamar navigate. Agora existe uma fixture permitida que coloca o teste em uma rota inicial conhecida, e a única maneira do agente alcançar o novo recurso é clicando pela interface — o que o força a adicionar o item de menu para fazer o teste passar.

O resultado: o problema nunca mais ocorrerá, não por causa de um prompt melhor, mas porque o comportamento correto é o único comportamento possível.

Conclusão Principal

Pare de corrigir a saída do modelo. Comece a restringir o ambiente dele para que a saída correta seja o caminho de menor resistência. Cada erro é uma oportunidade de projetar para eliminar o próximo.

📖 Leia a fonte completa: r/ClaudeAI

Ad

👀 See Also

OpenClaw WhatsApp Auto-Resposta Pode Ignorar Compreensão de Mídia na Versão 2026.4.2
Tips

OpenClaw WhatsApp Auto-Resposta Pode Ignorar Compreensão de Mídia na Versão 2026.4.2

Um usuário relata que o fluxo de resposta automática do WhatsApp do OpenClaw 2026.4.2 pode pular o pipeline de compreensão de mídia, impedindo a transcrição de notas de voz ao usar backends de STT externos como o Groq. A correção envolve chamar explicitamente a compreensão de mídia antes do despacho do agente.

OpenClawRadar
Inchaço de tokens em frameworks de agentes: uma relação de entrada-saída de 500:1 é normal
Tips

Inchaço de tokens em frameworks de agentes: uma relação de entrada-saída de 500:1 é normal

Um usuário de um framework de agente auto-hospedado relata ~21k tokens de entrada por mensagem e uma proporção de 500:1 entre entrada e saída, provenientes de definições de ferramentas, prompt do sistema e memória. A comunidade confirma que 15-25k de contexto base é comum para agentes que usam ferramentas.

OpenClawRadar
Executando MiniMax M2.7 Q8_0 128K em 2x3090 com Offloading de CPU – Benchmarks e Configurações do Mundo Real
Tips

Executando MiniMax M2.7 Q8_0 128K em 2x3090 com Offloading de CPU – Benchmarks e Configurações do Mundo Real

Um usuário executa com sucesso o MiniMax M2.7 em Q8_0 com 128K de contexto em duas RTX 3090 mais RAM DDR4, alcançando ~50 tps no processamento de prompt e ~10 tps na geração de tokens, e compartilha suas flags do llama-server.

OpenClawRadar
Gerenciando o Consumo de Tokens do Claude AI: Dicas Práticas da Experiência de Desenvolvedores
Tips

Gerenciando o Consumo de Tokens do Claude AI: Dicas Práticas da Experiência de Desenvolvedores

Um desenvolvedor relata ter consumido 94.000 tokens em 3 minutos usando o recurso Explore do Claude, resultando em limitação de taxa por 4 horas, e compartilha estratégias concretas incluindo manter um arquivo ARCHITECTURE.md e usar prompts cirúrgicos para controlar o uso de tokens.

OpenClawRadar