Claude Opus 4.6のeffort=lowパラメータは、エージェントの怠惰な動作を引き起こします。

Claude Opus 4.6のeffortパラメータは、他のAIプロバイダーの類似設定とは異なる動作をし、lowに設定すると予期せぬエージェントの挙動を引き起こします。
主な発見
テストにより、effort=lowではClaude Opus 4.6が予想以上に著しく怠惰な挙動を示すことが明らかになりました:
- ツール呼び出しが減少
- クロスリファレンスの徹底性が低下
- ウェブ調査の方法を指示するシステムプロンプトの一部を実質的に無視
- 情報の探索を停止したため、自信を持って誤った回答を返す
ソースによると、effort=mediumに上げることでこれらの問題はすべて解決されました。ドキュメントによれば、Anthropicのeffortパラメータは、OpenAIのreasoning.effort=lowやGeminiのthinking_level=lowのような推論の深さだけでなく、一般的な行動の努力度を制御します。
重要な区別
これはバグではなく、実装上の文書化された違いです。Claude Opus 4.6のeffortパラメータは、他のプロバイダーの同等パラメータよりも広範な範囲を持っています。これは、異なるAIプロバイダー間で作業する際に、effortをreasoning.effortやthinking_levelの代替として扱えないことを意味します。
テストは、effort=lowが他のプロバイダーの低努力設定と同様に動作すると期待して実施されましたが、実際の挙動はより極端で、単に思考が少ないだけでなく、全体的に怠惰なエージェントが生じる結果となりました。
📖 Read the full source: r/LocalLLaMA
👀 See Also

EFF: トランプ政権、自律型兵器業務を拒否したAnthropicに報復
ペンタゴンは、アンソロピックがAIモデルの自律型兵器や大量監視への使用を拒否したことに対して報復し、憲法修正第1条に違反しているとEFFが主張。

Meta、AIトレーニングのために従業員のマウス操作とキー入力を記録へ
ロイター通信の報道によると、MetaはAIトレーニングデータとして従業員のマウス操作とキー入力を収集する計画を立てています。この記事はHacker Newsで33ポイントと7コメントを集め、議論を呼んでいます。

形式的に検証された3D CSGメッシュ交差: AIコードではなく93行の仕様を信頼する
Lean 4で形式検証された3Dメッシュ交差。93行の仕様だけを信頼し、1000行以上のAI生成コードは不要。Webデモはブラウザで動作。

AppleのlibibverbsがGPUDirect RDMAシンボルを隠蔽;macOSでゼロコピーMetalバッファRDMAが動作
開発者が、AppleのRDMAサブシステムがMetal GPUバッファをゼロコピーネットワーク転送に受け入れることを発見し、隠されたibv_reg_dmabuf_mrシンボルがmacOSでカーネル修正なしにGPUDirect RDMAが可能であることを示唆していることを発見した。