Claude 4.6 Adaptive Thinking: Redditユーザーがトークンの浪費を報告し、無効化コマンドを提供

✍️ OpenClawRadar📅 公開日: March 2, 2026🔗 Source
Claude 4.6 Adaptive Thinking: Redditユーザーがトークンの浪費を報告し、無効化コマンドを提供
Ad

Claude 4.6の適応的思考機能

Claude 4.6モデルでは、タスクの複雑さに基づいてモデルがどれだけの推論を行うかを自己調整する適応的思考機能が導入されています。単純なタスクには迅速な応答が、複雑なタスクにはより深い思考が促されます。

Claude Codeでの報告された問題点

Redditの投稿によると、Claude Codeでは、すべてのツール呼び出しの間に拡張思考が発生します。クイック編集、リント修正、短いやり取りなどの反復的なコーディングワークフローでは、追加される遅延が顕著です。ユーザーは、有用な進捗をもたらさない思考ループで、高価な出力トークンを数万も消費しているのを目にすることがあると報告しています。

適応的思考を制御するシェルコマンド

ソースでは、シェルプロファイル用に以下のbashコマンドが提供されています:

export MAX_THINKING_TOKENS=$((1024*3))
export CLAUDE_CODE_DISABLE_ADAPTIVE_THINKING=1

MAX_THINKING_TOKENSは、1ターンあたりの推論予算を3072トークンに制限します。CLAUDE_CODE_DISABLE_ADAPTIVE_THINKINGは、Claude Codeが自動的に拡張思考をトリガーするのを停止します。

ユーザーは、自身の経験から、適応的思考はセッション制限の無駄遣いに感じられ、通常2〜8kの思考トークンで十分であると述べています。また、適応的思考がなければ達成できなかったタスクを完了するのに役立つと感じているユーザーからの議論を歓迎しています。

📖 完全なソースを読む: r/ClaudeAI

Ad

👀 See Also

别再让AI代理设计你的架构
News

别再让AI代理设计你的架构

ClaudeのようなAIエージェントは病的に同調的で、もっともらしいが文脈を無視したアーキテクチャを生成します。彼らは「ノー」と言えず、チームの制約を知らず、シニアエンジニアをチケット実装者に変えてしまいます。

OpenClawRadar
AIエージェント時代における「構築と購入のパラドックス」
News

AIエージェント時代における「構築と購入のパラドックス」

時給100ドルの開発者が、月額30~50ドルの既存製品を避けて、Claudeとn8nで10時間以上かけて自作するという、1,000ドル以上の機会損失を無視した行動が広がっている。

OpenClawRadar
オーケストレーター:なぜ意図がプロセスを超えて存続すべきか
News

オーケストレーター:なぜ意図がプロセスを超えて存続すべきか

現在のエージェントスタックはアイデンティティとサーフェスを逆転させている——オーケストレーション層はエージェントとランタイムの間に位置し、アイデンティティ、ルーティング、ハンドオフプリミティブ、クロスドライバー呼び出しを提供すべきである。実例:単一のインテントでOllama、Gemini CLI、Grok Buildを横断して不安定なテストをトリアージする。

OpenClawRadar
Qwen 3.6-35B-A3B KVキャッシュベンチ:M5 Max上のf16対q8_0対Turbo3対Turbo4、最大1Mコンテキスト
News

Qwen 3.6-35B-A3B KVキャッシュベンチ:M5 Max上のf16対q8_0対Turbo3対Turbo4、最大1Mコンテキスト

M5 MaxでのTheTomのTurboQuant Metalフォークのベンチマークでは、f16とq8_0は256Kを超えるとOOMになる一方、turbo3は1Mで6.5 tok/sのデコードを達成。コンテキストが長い場合、プリフィルはturbo3、デコードはturbo4が優位。

OpenClawRadar