Eficiencia de Tokens en Opus 4.7: Los Prompts en Alemán Consumen Hasta el Doble de Tokens que en Inglés

El tokenizador de Claude tiene un sesgo de idioma conocido, y una publicación reciente en r/ClaudeAI demuestra el impacto real de usar idiomas no ingleses con el modelo Opus 4.7.
El problema
Un suscriptor Pro ejecutó un prompt de análisis de acciones (pronosticando The Trade Desk, Coreweave, Cloudflare) primero en inglés y luego en alemán. Resultados:
- Inglés (Opus 4.7 Extended): consumió 37 % de los tokens de sesión
- Inglés (Opus 4.6): 33 %
- Inglés (Sonnet): ~28 %
- Alemán (Opus 4.7): 100 % en segundos
El mismo prompt en alemán con el mismo modelo agotó casi instantáneamente el límite de sesión completo.
Por qué sucede
Claude tokeniza el texto. El inglés promedia ~1 token por cada 0,75 palabras; el alemán promedia ~1 token por cada 0,5 palabras, a veces peor. Sustantivos compuestos como Aktienmarktanalyse se dividen en más tokens que stock market analysis, y las diéresis junto con una menor cobertura de datos de entrenamiento inflan los recuentos. Para contenido semántico equivalente, un prompt y respuesta en alemán puede consumir de 1,5 a 2 veces los tokens del inglés.
Soluciones alternativas
El propio modelo sugiere dos mitigaciones:
- Escribir el prompt en alemán pero pedir respuestas en inglés — por ejemplo, las etiquetas de las hojas de cálculo permanecen en inglés mientras la conversación sigue en alemán
- Pedir al modelo que sea más conciso para reducir el recuento de tokens de salida
Anthropic es consciente del problema de coste de tokens multilingüe, pero es una propiedad estructural del tokenizador, no algo que se pueda parchear del lado del cliente.
Conclusión
Si usas Claude en un idioma distinto al inglés y te topas con los límites de sesión, probablemente esta sea la razón. Para flujos de trabajo pesados (llamadas a herramientas, búsquedas web, salidas largas), considera cambiar al inglés para la salida a fin de conservar tokens.
📖 Lee la fuente completa: r/ClaudeAI
👀 Ver también

AWS Bedrock elimina silenciosamente la cuota de Claude Opus 4.7: Una advertencia para flujos de trabajo de IA en producción
Un usuario de HN informa que AWS Bedrock estableció su cuota de Claude Opus 4.7 en 0 sin previo aviso. El soporte de AWS confirma que fue una actualización del sistema y no puede garantizar la restauración. Se recomienda a los usuarios migrar a Opus 4.6 o cambiar de proveedor.

Error en el Código de Claude Reemplaza Umlauts Alemanes con Sustitutos ASCII
Desde diciembre de 2025, Claude Code y la aplicación Claude.ai han estado reemplazando aleatoriamente las diéresis alemanas (ä, ö, ü, ß) con sustitutos ASCII (ae, oe, ue, ss). El error persiste a pesar de instrucciones explícitas y no se ha corregido durante más de 3 meses sin respuesta del soporte de Anthropic.

Propuesta de Enrutamiento de Inferencia Adaptativa para la Eficiencia de Consultas de IA
Una propuesta presentada a Anthropic en abril de 2026 describe un sistema de cinco pasos para dirigir consultas a modelos de IA apropiados según una puntuación de complejidad, utilizando señales simples como el recuento de caracteres y de oraciones antes de que ocurra cualquier inferencia del modelo.

Economía de los Videos de Sora AI: Cada Usuario de $20 Cuesta $65 en Cómputo a OpenAI
La aplicación de generación de videos con IA Sora de OpenAI cuesta aproximadamente $65 en cómputo por cada usuario de $20/mes, con costos máximos de inferencia estimados en $15 millones diarios frente a $2.1 millones de ingresos totales de por vida.