O benchmark IDP Leaderboard mostra que o Claude Sonnet 4.6 iguala o Opus 4.6 em tarefas de IA para documentos.

O IDP Leaderboard, um benchmark aberto para IA de documentos, publicou resultados comparando os modelos Claude em tarefas de processamento de documentos. O benchmark testou 16 modelos em várias categorias usando mais de 9.000 documentos reais.
Resultados do Benchmark
As pontuações dos modelos Claude no IDP Leaderboard:
- Claude Sonnet 4.6: 80,8 no geral
- Claude Opus 4.6: 80,3 no geral
- Claude Haiku 4.5: 69,6 no geral
Sonnet e Opus tiveram desempenho essencialmente equivalente em tarefas de extração, incluindo texto, tabelas, fórmulas e análise de layout. Os gráficos de radar de ambos os modelos são idênticos de acordo com os resultados do benchmark.
Comparação de Custos
A fonte observa diferenças significativas de custo:
- Sonnet custa US$ 24 por 1.000 páginas
- Opus custa US$ 40 por 1.000 páginas
Para cargas de trabalho de processamento de documentos, o benchmark sugere que não há motivo para usar o Opus, considerando o desempenho equivalente a um custo menor.
Advertência Importante
Uma descoberta notável: os modelos Claude tinham moderação de conteúdo mais rigorosa, o que afetou o desempenho em certos tipos de documentos. Digitalizações de jornais antigos, páginas de livros didáticos e documentos históricos às vezes acionaram filtros de conteúdo. Esse problema só apareceu nos benchmarks OlmOCR e OmniDoc.
Todas as previsões do benchmark estão visíveis no Results Explorer em idp-leaderboard.org, onde você pode ver exatamente o que cada modelo Claude produziu em cada documento.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Proposta de Roteamento de Inferência Adaptativa para Eficiência de Consultas de IA
Uma proposta enviada à Anthropic em abril de 2026 descreve um sistema de cinco etapas para direcionar consultas aos modelos de IA apropriados com base em uma pontuação de complexidade, usando sinais simples como contagem de caracteres e de frases antes que qualquer inferência do modelo ocorra.

Filme de Cannes custou US$ 500 mil para ser feito, US$ 400 mil foram custos de computação de IA
Um filme exibido em Cannes custou US$ 500 mil para ser produzido; US$ 400 mil foram gastos em computação de IA. Um dado marcante para desenvolvedores de agentes de IA que criam pipelines de vídeo generativo.
Vibe Coding Tem Dois Significados — Qual Deles Você Está Usando?
Um post no Reddit argumenta que 'vibe coding' confunde duas práticas distintas: despejo descuidado de código e assistência significativa de IA. Essa ambiguidade cria atritos de comunicação desnecessários entre desenvolvedores.

Detalhes do Acordo de Direitos Autorais da Anthropic para Desenvolvedores
A Anthropic resolveu uma ação coletiva de direitos autorais de US$ 1,5 bilhão por usar obras para treinar modelos de IA. Proprietários de direitos autorais elegíveis podem reivindicar US$ 500–US$ 3.000 por obra validada, com prazo até 23 de março de 2026.