Claude CodeのA/Bテスト、「高」努力を旧「低」レベルに静かに縮小
Claude Codeを使用している開発者は、今週、突然のパフォーマンス低下に気づいたかもしれません。Xユーザー@argofowlの報告によると、Anthropicはサーバー側でA/Bテストを実施しており、特定のセッションの実効努力レベルを静かに低減させています。この変更はClaude Codeバージョン2.1.236以降に影響し、モデルは「高」努力を100点中10点として解釈します。これは以前「低」が使用していた正確な値です。古いバージョンとOpus 5は影響を受けず、チェンジログには記載されていません。
重要な詳細
- 影響を受けるバージョン: Claude Code 2.1.236+(特に2.1.237以降で確認)
- 変更内容: 努力スケールがサーバー側で縮小され、「高」は以前のより高い値ではなく、10/100にマッピングされます。
- 範囲: 登録されたセッションのみ — A/Bテストのため、全員が対象ではありません。
- 検出方法: 「高」が「低」のように感じられる場合、テストグループに含まれています。
- チェンジログなし: この変更は公開ドキュメントなしで行われました。
報告者の@argofowlは、自分のツールが壊れたと思い込んで半日を費やした後、この問題を発見しました。彼はAnthropicの不透明なテスト手法に不満を表明しました。「まったく、Anthropic、お前たちは時々我慢ならないよ」
分析
これはクライアント側の修正ではなく、モデルが努力パラメータを解釈する方法に影響を与えるサーバー側の設定です。バージョン2.1.236以降で、「高」に設定しても出力品質が低下していることに気づいた場合、この実験に参加している可能性があります。テストを回避するには、古いバージョン(例:2.1.235以前)に固定するか、Anthropicが変更を展開または元に戻すのを待つことができます。A/Bテストのため、体験は異なる場合があります。
一貫したAIコーディングエージェントの動作に依存している開発者にとって、この種の静かな変更は懸念されます。Anthropicからの公式声明はまだなく、公開チェンジログにも記載されていません。影響を受ける場合は、Claude Codeのバージョンを確認し、安定したパフォーマンスを確保するためにダウングレードを検討してください。
📖 ソース全文を読む: HN AI Agents
👀 See Also

Redditの議論では、AI生成コードのデバッグにおける課題が浮き彫りにされています。
r/ClaudeAIでのRedditディスカッションでは、AI生成コードが開発者に直面させる具体的な問題が詳細に語られています。これには、セキュリティの脆弱性、論理の幻覚、そして手動でコードを書くよりも時間がかかるデバッグ作業などが含まれます。

Claude Codeの約12,000トークンの強制システムプロンプトの分析がユーザー設定を上書きする優先ルールを明らかに
Claude Codeに注入されている約12Kトークンのシステムプロンプトの分析により、歌詞禁止、サブエージェント委任、簡潔さの優先ルールが、ユーザー定義のCLAUDE.mdやメモリファイルを上書きすることが明らかになった。

AI搭載ロボット犬がアトランタで監視任務に配備
カメラとAIを搭載した四足歩行ロボット犬が、アトランタの通り、アパート、建設現場を巡回し、24時間365日、360度ビデオを遠隔オペレーターにストリーミング配信しています。これは人間の警備員よりも安価な代替手段として導入されています。

Claude APIの利用データが、Maxプランユーザーへの新制限の影響を示す
Claude Max 20xのユーザーが報告したところによると、新たな制限が導入された後、API相当の日次使用量が約210ドル/日から約52ドル/日に低下し、SonnetやCodexの使用を含む大幅なワークフローの変更が必要となった。