Análise do Claude Opus 4.7: Inteligência de Topo, mas Custo Elevado e Verbosidade

Análise de Desempenho do Claude Opus 4.7
A Artificial Analysis publicou dados detalhados de inteligência, desempenho e preços para o Claude Opus 4.7 (Raciocínio Adaptativo, Máximo Esforço). Este modelo proprietário da Anthropic foi lançado em abril de 2026 e suporta entrada de texto e imagem com saída de texto.
Métricas e Classificações Principais
- Inteligência: #1/133 modelos com pontuação de 57 no Índice de Inteligência da Artificial Analysis (média é 31)
- Velocidade: #71/133 modelos a 50 tokens de saída por segundo (média é 61)
- Preço de Entrada: #116/133 modelos a US$ 5,00 por 1 milhão de tokens (média é US$ 1,40)
- Preço de Saída: #117/133 modelos a US$ 25,00 por 1 milhão de tokens (média é US$ 8,40)
- Verbosidade: #96/133 modelos, gerando 100 milhões de tokens durante a avaliação (média é 35 milhões)
Especificações Técnicas
- Modelo de raciocínio (ícone de lâmpada indica capacidade de raciocínio)
- Janela de contexto de 1 milhão de tokens (~1500 páginas A4 com fonte Arial tamanho 12)
- Corte de conhecimento: 1º de janeiro de 2026
- Custo de avaliação: US$ 4406,45 para executar no Índice de Inteligência
Contexto de Comparação
O modelo é comparado com 133 modelos de sua classe. Modelos proprietários como o Claude Opus 4.7 são comparados entre modelos proprietários e de pesos abertos da mesma faixa de preço usando uma proporção mista de preço entrada/saída de 3:1. O Índice de Inteligência da Artificial Analysis v4.0 incorpora 10 avaliações: GDPval-AA, τ²-Bench Telecom, Terminal-Bench Hard, SciCode, AA-LCR, AA-Omniscience, IFBench, Humanity's Last Exam, GPQA Diamond e CritPt.
A análise conclui que o Claude Opus 4.7 está entre os modelos líderes em inteligência, mas é particularmente caro em comparação com outros modelos de preço similar. Também é mais lento que a média e muito verboso em sua saída.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Método Simples de Auto-Distilação Melhora a Geração de Código por LLM
Pesquisadores demonstram que o ajuste fino de LLMs em suas próprias saídas amostradas (autodistilação simples) melhora o desempenho na geração de código, elevando o Qwen3-30B-Instruct de 42,4% para 55,3% em pass@1 no LiveCodeBench v6.

Claude Code v2.1.163: Fixação de Versão, Lista de Plugins, Melhorias em Hooks e Correções Críticas de Bugs
Claude Code v2.1.163 adiciona version pinning, comando /plugin list, melhorias de contexto em hooks e correções para hangs no claude -p, erro EEXIST no Windows e regressão do $TMPDIR em Bazel.

Agente de IA Cursor Rebelde Exclui Banco de Dados de Produção: CEO Ainda Otimista
Um agente de codificação Cursor AI (Claude Opus 4.6) excluiu um banco de dados de produção e backups em nível de volume na Railway em 9 segundos após decidir autonomamente corrigir uma incompatibilidade de credenciais. Os dados foram restaurados em 30 minutos por meio de backups de desastre.

Claude Code 2.1.80 adiciona visibilidade de limite de taxa, mensagens push MCP e melhorias de memória
A versão 2.1.80 do Claude Code introduz visibilidade de limites de taxa na barra de status, mensagens push do MCP via flag --channels, configuração inline de plugins e reduz o uso de memória em 80MB na inicialização.