Claude CodeのA/Bテスト、「高」努力を旧「低」レベルに静かに縮小
Claude Codeを使用している開発者は、今週、突然のパフォーマンス低下に気づいたかもしれません。Xユーザー@argofowlの報告によると、Anthropicはサーバー側でA/Bテストを実施しており、特定のセッションの実効努力レベルを静かに低減させています。この変更はClaude Codeバージョン2.1.236以降に影響し、モデルは「高」努力を100点中10点として解釈します。これは以前「低」が使用していた正確な値です。古いバージョンとOpus 5は影響を受けず、チェンジログには記載されていません。
重要な詳細
- 影響を受けるバージョン: Claude Code 2.1.236+(特に2.1.237以降で確認)
- 変更内容: 努力スケールがサーバー側で縮小され、「高」は以前のより高い値ではなく、10/100にマッピングされます。
- 範囲: 登録されたセッションのみ — A/Bテストのため、全員が対象ではありません。
- 検出方法: 「高」が「低」のように感じられる場合、テストグループに含まれています。
- チェンジログなし: この変更は公開ドキュメントなしで行われました。
報告者の@argofowlは、自分のツールが壊れたと思い込んで半日を費やした後、この問題を発見しました。彼はAnthropicの不透明なテスト手法に不満を表明しました。「まったく、Anthropic、お前たちは時々我慢ならないよ」
分析
これはクライアント側の修正ではなく、モデルが努力パラメータを解釈する方法に影響を与えるサーバー側の設定です。バージョン2.1.236以降で、「高」に設定しても出力品質が低下していることに気づいた場合、この実験に参加している可能性があります。テストを回避するには、古いバージョン(例:2.1.235以前)に固定するか、Anthropicが変更を展開または元に戻すのを待つことができます。A/Bテストのため、体験は異なる場合があります。
一貫したAIコーディングエージェントの動作に依存している開発者にとって、この種の静かな変更は懸念されます。Anthropicからの公式声明はまだなく、公開チェンジログにも記載されていません。影響を受ける場合は、Claude Codeのバージョンを確認し、安定したパフォーマンスを確保するためにダウングレードを検討してください。
📖 ソース全文を読む: HN AI Agents
👀 See Also

インドのSarvamとKrutrimは、現地のニーズに応じた倹約的なAIモデルを構築しています。
インドのスタートアップSarvam AIとKrutrimは、ローエンドスマートフォンや低帯域幅ネットワーク向けに最適化された独自のAIモデルを開発しており、Sarvamの240億パラメータを持つSarvamMモデルは10のインド言語でトレーニングされています。

Claude Code System Prompts v2.1.53-2.1.55: メモリ選択機能追加、コマンド実行機能削除
Claude Codeシステムプロンプトのバージョン2.1.53から2.1.55では、メモリ選択の指示(156トークン)が追加され、コマンド実行スペシャリスト(109トークン)が削除され、プロンプトが約70のアトミックファイルに再編成されました。バックグラウンドエージェントは、出力ファイルパスを提供する代わりに、完了時に自動通知を行うようになりました。

「知らない、クロードが書いた」パンデミック:コードの所有権が認知放棄に取って代わられるとき
エンジニアがClaudeにアーキテクチャの決定を委ね、プルリクエストを説明できなくなる。Addy Osmaniはこれを「認知的な降伏」と呼ぶ——AIの出力をレビューせず自分のものにする現象。

Claude Code v2.1.200:主要修正と権限モードの変更
Claude Code v2.1.200 では、AskUserQuestion ダイアログが自動継続しなくなり、デフォルトのパーミッションモードが Manual に変更されました。また、バックグラウンドエージェントのクラッシュやロスターの破損が修正されています。