Estrutura Prática para Escolher entre os Modelos Haiku, Sonnet e Opus da Claude

Um desenvolvedor com meses de experiência diária usando todos os três modelos do Claude (Haiku 4.5, Sonnet 4.6, Opus 4.6) os testou na mesma tarefa de codificação para determinar quando usar cada um. O teste envolveu refatorar um backend de 400 linhas em Express.js para usar padrões adequados de middleware e adicionar validação de entrada.
Desempenho dos Modelos na Tarefa de Codificação
O Haiku 4.5 lidou com partes diretas, como extrair middleware e adicionar express-validator, mas perdeu uma dependência sutil entre duas funções de middleware onde a ordem importava.
O Sonnet 4.6 capturou o problema de ordenação do middleware e reestruturou corretamente a cadeia de tratamento de erros. Ele também adicionou tipos TypeScript sem ser solicitado.
O Opus 4.6 fez tudo o que o Sonnet fez, mas também sinalizou que o middleware de autenticação estava verificando permissões depois que o manipulador de rota já havia acessado o banco de dados — um problema de segurança que passou despercebido por meses.
Comparação de Preços
- Haiku: US$ 0,25 entrada / US$ 1,25 saída por milhão de tokens
- Sonnet: US$ 3 / US$ 15 por milhão de tokens
- Opus: US$ 15 / US$ 75 por milhão de tokens
O Opus custa 60 vezes mais que o Haiku por token. Para tarefas em que o Haiku acerta, usar o Opus é ineficiente.
Estrutura de Uso Prático
- Haiku → operações em lote, transformação de dados, classificação, qualquer coisa repetitiva em muitas chamadas
- Sonnet → codificação diária, trabalho de recursos, revisão de código, 90% das tarefas
- Opus → decisões de arquitetura, revisão de segurança, depuração complexa onde perder algo custa horas
O desenvolvedor relata que combinar o modelo com a complexidade da tarefa reduziu os custos da API em aproximadamente 70% sem perda de qualidade em tarefas importantes.
Todos os três modelos agora suportam pensamento estendido, mas isso faz a maior diferença com o Opus em tarefas de raciocínio complexo. Para o Haiku, o pensamento estendido mal muda a saída.
📖 Read the full source: r/ClaudeAI
👀 See Also

Corrigindo erros de 'Navigate Unsupported' e plugins do navegador no OpenClaw auto-hospedado no Docker
Correção passo a passo para erros de permissão EACCES, falta de Playwright e binários do Chromium ao hospedar o OpenClaw com Docker em um VPS como Hostinger.

Implementando um Sistema de Meditação Recorrente para a Coerência do Agente OpenClaw
Um desenvolvedor compartilha um sistema estruturado de reflexão para agentes OpenClaw usando uma cadeia específica de arquivos, incluindo meditations.md, reflections/*.md e arquivos de identidade. O ciclo noturno envolve revisar e adicionar a esses arquivos para promover insights sobre mudanças duradouras de comportamento.

Subagentes OpenClaw: Não Trate uma Resposta como Confirmação de Conclusão
O sessions_spawn do OpenClaw é não bloqueante — ele retorna um runId quando o trabalho é aceito, não concluído. Um pai pode reportar sucesso prematuramente enquanto um filho ainda está em execução, falhou ou se perdeu.

Qwen3.5-397B MoE roda em 14GB de RAM via carregamento paginado de especialistas no M1 Ultra
O mecanismo Paged MoE mantém apenas 20 especialistas residentes e carrega o restante sob demanda do SSD, executando um modelo de 397B com 209GB em um Mac Studio de 64GB com 1,59 tok/s e pico de RAM de 14GB. Inclui benchmarks de modelos menores.