Эффективность токенов Opus 4.7: немецкие промпты расходуют до 2 раз больше токенов по сравнению с английскими

✍️ OpenClawRadar📅 Опубликовано: 10 мая 2026 г.🔗 Source
Эффективность токенов Opus 4.7: немецкие промпты расходуют до 2 раз больше токенов по сравнению с английскими
Ad

Токенизатор Claude имеет известный языковой перекос, и недавний пост на r/ClaudeAI демонстрирует реальное влияние использования неанглийских языков с моделью Opus 4.7.

Проблема

Подписчик Pro запустил один и тот же промпт для анализа акций (прогноз по The Trade Desk, Coreweave, Cloudflare) сначала на английском, затем на немецком. Результаты:

  • Английский (Opus 4.7 Extended): израсходовано 37% токенов сессии
  • Английский (Opus 4.6): 33%
  • Английский (Sonnet): ~28%
  • Немецкий (Opus 4.7): 100% за секунды

Тот же промпт на немецком языке с той же моделью исчерпал весь лимит сессии практически мгновенно.

Почему это происходит

Claude токенизирует текст. В английском в среднем ~1 токен на 0,75 слова; в немецком ~1 токен на 0,5 слова — иногда хуже. Сложные существительные вроде Aktienmarktanalyse разбиваются на большее количество токенов, чем stock market analysis, а умлауты и меньшее покрытие в тренировочных данных увеличивают число токенов. Для эквивалентного смыслового содержания немецкий промпт + ответ могут потреблять в 1,5–2 раза больше токенов, чем английский.

Ad

Обходные пути

Сама модель предлагает два решения:

  • Запрашивать на немецком, но просить ответ на английском — например, подписи в таблицах остаются на английском, а диалог ведется на немецком
  • Просить модель быть лаконичнее, чтобы уменьшить количество токенов в выводе

Anthropic знает о проблеме многоязычной стоимости токенов, но это структурное свойство токенизатора — его нельзя исправить на стороне клиента.

Вывод

Если вы используете Claude на языке, отличном от английского, и сталкиваетесь с лимитами сессии, скорее всего, причина в этом. Для интенсивных рабочих нагрузок (вызовы инструментов, поиск в Интернете, длинные выводы) рекомендуется переключаться на английский для вывода, чтобы экономить токены.

📖 Читайте полный источник: r/ClaudeAI

Ad

👀 Смотрите также

Сравнение затрат на API для LLM в 2026 году: самостоятельное размещение и облачные провайдеры
Новости

Сравнение затрат на API для LLM в 2026 году: самостоятельное размещение и облачные провайдеры

Пользователь Reddit сравнил стоимость API LLM для 1 млн токенов в день у 11 провайдеров, выяснив, что самостоятельный хостинг с vLLM стоит около $0,05 за 1 млн токенов, в то время как GPT-4o стоит $5/$15 за входные/выходные токены.

OpenClawRadar
Перестаньте позволять ИИ-агентам проектировать вашу архитектуру
Новости

Перестаньте позволять ИИ-агентам проектировать вашу архитектуру

AI-агенты вроде Claude патологически сговорчивы: выдают правдоподобные, но лишенные контекста архитектуры. Они не могут сказать «нет», не знают ограничений вашей команды и превращают опытных инженеров в исполнителей задач из тикет-систем.

OpenClawRadar
Почему активирующее управление Anthropic испытывает трудности с генерацией корректного JSON
Новости

Почему активирующее управление Anthropic испытывает трудности с генерацией корректного JSON

Метод активации управления, используемый для безопасности ИИ, не способен генерировать действительный JSON, достигая лишь 24,4% валидности по сравнению с 86,8% у необученной базовой модели.

OpenClawRadar
ИИ-агенты убивают ревью кода — объяснение проблемы «принципал-агент»
Новости

ИИ-агенты убивают ревью кода — объяснение проблемы «принципал-агент»

Внедрение AI-агентов в традиционный процесс проверки кода удваивает нагрузку на ревью, разрушает сигналы доверия и создает неустойчивый дисбаланс — это проблема принципала-агента в применении к разработке ПО.

OpenClawRadar