Opus 4.7 トークン効率: ドイツ語プロンプトは英語の最大2倍のトークンを消費

✍️ OpenClawRadar📅 公開日: May 10, 2026🔗 Source
Opus 4.7 トークン効率: ドイツ語プロンプトは英語の最大2倍のトークンを消費
Ad

Claude のトークナイザーには既知の言語バイアスがあり、最近の r/ClaudeAI への投稿では、Opus 4.7 モデルで英語以外の言語を使用した場合の実際の影響が示されています。

問題点

ある Pro 加入者が、まず英語、次にドイツ語で株式分析プロンプト(The Trade Desk、Coreweave、Cloudflare の予測)を実行しました。結果は次の通りです。

  • 英語(Opus 4.7 Extended): セッショントークンの 37% を消費
  • 英語(Opus 4.6): 33%
  • 英語(Sonnet): 約 28%
  • ドイツ語(Opus 4.7): 数秒で 100%

同じモデルで同じプロンプトをドイツ語で使用すると、セッション制限がほぼ瞬時に使い果たされました。

原因

Claude はテキストをトークン化します。英語では平均して 0.75 語あたり約 1 トークンですが、ドイツ語では 0.5 語あたり約 1 トークンで、場合によってはさらに悪化します。Aktienmarktanalyse のような複合名詞は stock market analysis よりも多くのトークンに分割され、ウムラウトとトレーニングデータのカバレッジの低さがトークン数をさらに増加させます。同じ意味内容であれば、ドイツ語のプロンプトと応答は英語の 1.5 倍から 2 倍のトークンを消費します。

Ad

回避策

モデル自体が 2 つの緩和策を提案しています。

  • プロンプトはドイツ語で書くが、応答は英語で依頼する — 例えば、スプレッドシートのラベルは英語のまま、会話はドイツ語で続ける
  • モデルに 簡潔に 回答するよう依頼し、出力トークン数を減らす

Anthropic は多言語トークンコストの問題を認識していますが、これはトークナイザーの構造的特性であり、クライアント側で修正できるものではありません。

まとめ

Claude を英語以外の言語で使用していてセッション制限に達している場合、これが原因である可能性が高いです。負荷の高いワークフロー(ツールコール、ウェブ検索、長い出力)では、出力を英語に切り替えてトークンを節約することを検討してください。

📖 出典全文: r/ClaudeAI

Ad

👀 See Also

AIは思考を高めるものであり、置き換えるものではない — エンジニアリングにおける隠れた分断についてコシー・ジョン
News

AIは思考を高めるものであり、置き換えるものではない — エンジニアリングにおける隠れた分断についてコシー・ジョン

Koshy John氏は、短期的な生産性向上のためにAIに思考を外注するエンジニアは中身のない基盤を築いているのに対し、AIを使って単純作業を排除し、より高度なレベルで活動するエンジニアは真の長期的価値を生み出すと主張する。

OpenClawRadar
Claude Max 100ドルサブスクリプションのAPI拡張タスク使用データ
News

Claude Max 100ドルサブスクリプションのAPI拡張タスク使用データ

Claude Maxの100ドルサブスクリプション利用者が、既存のAPIにお気に入りライブラリ機能を拡張するために5時間セッションの13%を消費したと報告。コンテキスト使用率は11%、週間使用率は5%から6%に増加。

OpenClawRadar
VibeThinker-3B:在AIME数学基准测试中与671B DeepSeek匹敌的3B参数模型
News

VibeThinker-3B:在AIME数学基准测试中与671B DeepSeek匹敌的3B参数模型

Sina Weiboの研究者が発表したVibeThinker-3Bは、3BパラメータでAIME 2026で94.3を記録し、DeepSeek V3.2(671B)に匹敵。論文は「パラメトリック圧縮・カバレッジ仮説」を提唱し、検証可能な推論が小規模モデルに圧縮可能だと主張。

OpenClawRadar
ThermoQA:エンジニアリング熱力学のためのオープンベンチマーク、293の計算問題でLLMをテスト
News

ThermoQA:エンジニアリング熱力学のためのオープンベンチマーク、293の計算問題でLLMをテスト

ThermoQAは、3つの階層にわたる293の工学熱力学問題からなるオープンベンチマークで、LLMの正確な数値計算能力をテストします。Claude Opus 4.6が94.1%の総合スコアで首位を走り、DeepSeek-R1は±2.5%で実行間のばらつきが最も大きくなっています。

OpenClawRadar