Opus 4.6 拡張思考は物理図問題で性能が低下

拡張思考モードにおけるパフォーマンスの問題
r/ClaudeAIのユーザーが、視覚的な図解の解釈を必要とする物理学の問題についてOpus 4.6とGemini 3.1 Proをテストしたと報告しました。このテストにより、拡張思考モードを使用した場合のOpus 4.6に特定のパフォーマンス低下が明らかになりました。
テストからの主な発見
- テスト範囲: 「問題の大部分がシナリオを示す視覚的な図解の解釈」である5つの物理学の問題
- 拡張思考モードを使用したOpus 4.6: 「図解の根本的な誤解により」5問すべてを「完全に間違えた」
- Gemini 3.1 Pro: 5問すべてを「完璧に解いた」
- 拡張思考モードを使用しないOpus 4.6: 問題を正常に解決し、「さらにずっと速かった」
ユーザーはこれを「本当に奇妙な動作」と表現しました。拡張思考モードは通常パフォーマンスを向上させますが、この特定の図解解釈の場合には一貫した失敗を引き起こしたからです。
📖 Read the full source: r/ClaudeAI
👀 See Also

Claude Opus 4.6のeffort=lowパラメータは、他のプロバイダーの低推論モードとは異なります。
Claude Opus 4.6のeffort=lowパラメータは、OpenAIのreasoning.effort=lowやGeminiのthinking_level=lowとは異なり、推論の深さだけでなく一般的な行動努力を制御します。これにより、エージェントはツール呼び出しを減らし、情報の相互参照が不十分になり、ウェブ調査に関するシステムプロンプトの一部を無視するようになりました。

クラウドアプリ、ペンタゴンとの紛争後、米国App Storeで2位にランクイン
AnthropicのClaudeチャットボットアプリは、Appleの米国App Storeで無料アプリランキング2位に上昇し、2026年1月下旬にはトップ100圏外だったのが、2月下旬までに2位まで急上昇しました。この急上昇は、同社がAI使用制限をめぐって国防総省と公に交渉した後に起こりました。

Claude Code v2.1.150、ネットワーク経由のリモートシステムプロンプトインジェクションを追加
Claude Code v2.1.150は、起動時および60秒ごとにAnthropicサーバーからシステムプロンプトをGrowthBookフィーチャーフラグ経由で取得し、リモートインジェクションを可能にします。ブロックするにはCLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC=1を設定してください。

エージェンティックコーディングは罠:認知的負債と萎縮
Lars Fayeは、Claude Codeのようなエージェンティックコーディングツールが認知の萎縮、ベンダーロックイン、複雑性の増大を引き起こし、コードを書く負担から生成されたコードをレビューする負担へと移行させ、開発者のスキルを低下させると主張している。