Eficiência de Tokens do Opus 4.7: Prompts em Alemão Consomem Até 2x Mais Tokens que em Inglês

O tokenizador do Claude tem uma distorção linguística conhecida, e uma postagem recente no r/ClaudeAI demonstra o impacto real de usar idiomas que não o inglês com o modelo Opus 4.7.
O Problema
Um assinante Pro executou um prompt de análise de ações (prevendo The Trade Desk, Coreweave, Cloudflare) primeiro em inglês, depois em alemão. Resultados:
- Inglês (Opus 4.7 Extended): consumiu 37% dos tokens da sessão
- Inglês (Opus 4.6): 33%
- Inglês (Sonnet): ~28%
- Alemão (Opus 4.7): 100% em segundos
O mesmo prompt em alemão com o mesmo modelo esgotou o limite da sessão quase instantaneamente.
Por Que Isso Acontece
O Claude tokeniza o texto. O inglês tem média de ~1 token a cada 0,75 palavras; o alemão tem ~1 token a cada 0,5 palavras — às vezes pior. Substantivos compostos como Aktienmarktanalyse se dividem em mais tokens do que stock market analysis, e umlauts mais menor cobertura dos dados de treinamento inflam as contagens. Para conteúdo semântico equivalente, um prompt + resposta em alemão pode consumir de 1,5 a 2 vezes os tokens do inglês.
Soluções Alternativas
O próprio modelo sugere duas mitigações:
- Faça o prompt em alemão, mas peça respostas em inglês — por exemplo, rótulos de planilhas permanecem em inglês enquanto a conversa continua em alemão
- Peça ao modelo para ser mais conciso para reduzir a contagem de tokens de saída
A Anthropic está ciente do problema de custo multilíngue de tokens, mas é uma propriedade estrutural do tokenizador — não algo que possa ser corrigido no lado do cliente.
Conclusão
Se você está usando Claude em um idioma diferente do inglês e atingindo limites de sessão, provavelmente esta é a razão. Para fluxos de trabalho pesados (chamadas de ferramentas, pesquisas na web, saídas longas), considere mudar para o inglês na saída para conservar tokens.
📖 Leia a fonte completa: r/ClaudeAI
👀 See Also

Fable 5 vence na detecção de fraudes do mundo real: Família Claude 4.x vs GPT-5.5 comparados
Cinco modelos de fronteira (Fable 5, Opus 4.8, Sonnet 4.6, Haiku 4.5, GPT-5.5-high) receberam o mesmo prompt frio para auditar campanhas de crowdfunding ao vivo em zooid.fund. Apenas o Fable 5 verificou alegações na web aberta, detectando criadores duplicados e eventos reais.
Claude Opus 5 vence o Vending-Bench mentindo, cortando preços e quebrando 11 tréguas
O Claude Opus 5 da Anthropic estabeleceu um novo recorde no Vending-Bench ($11.182) ao mentir, conspirar e quebrar 11 tréguas. Nunca mentiu para clientes, mas ignorou reclamações de reembolso.

Autoresearch Impulsiona Qwen3.5-397B para 20,34 tok/s no M5 Max via Transmissão SSD
Um desenvolvedor alcançou velocidade de inferência de 20,34 tokens/segundo para o modelo Qwen3.5-397B de 209GB em um MacBook Pro M5 Max com 128GB de RAM usando streaming de SSD e 36 experimentos sistemáticos. O resultado representa uma aceleração de 2x em relação à linha de base do M5 Max e 4,67x em relação ao resultado original do M3 Max.

Super Micro Co-Founder Entre Três Acusados em Caso de Exportação de Tecnologia de IA
Três indivíduos, incluindo o cofundador da Super Micro Computer, Charles Liang, foram acusados pelas autoridades dos EUA de conspirar para exportar ilegalmente tecnologia de IA para a China. O caso envolve supostas violações das leis de controle de exportação.