Claude Codeセッションで価値を最大化する:トークン効率化のヒント

Anthropicは、Claude Codeセッションで使うすべてのトークンから最大の価値を引き出すための実践的なガイドを公開しました。トークンの価格設定の仕組みを説明し、モデルを切り替えずに無駄を減らすための6つの具体的な戦術を提供しています。
トークンのコストを決めるもの
トークンごとに課金されますが、実際に支払っているのはGPU推論時間です。トークンの価格を決める3つの要素は、モデルのサイズ、入力と出力、キャッシュです。出力トークンは入力の約5倍のコストがかかります。なぜなら、デコードはトークンごとにモデルを1回実行するからです。キャッシュされた入力トークンはより安価で、プロンプトキャッシュは1時間で失効します。
トークンの無駄を減らす6つの方法
- タスク間で
/clearを実行する — 無関係な以前のコンテキストがモデルに送信されるのを防ぎ、トークン使用量を削減します。 - 開始前にモデルと努力レベルを設定する — 会話の途中で変更すると、プロンプトキャッシュが壊れ、コストが増加します。
- ファイル名を指定する代わりに@メンションを使用する — ファイルがメッセージに直接添付され、Read呼び出しやリポジトリ検索を節約できます。
- ノイズの多いコマンドに静かなフラグを追加するか、サブエージェントで実行する — コマンド出力はセッションの残り期間中会話に残ります。
- 新しいセッションで
/contextを1回実行する — 何が読み込まれているか(CLAUDE.md、MCPツール)が表示され、不要な項目を削除できます。 - 休憩前に
/compactを実行する — プロンプトキャッシュは1時間で失効し、キャッシュされている間に要約する方が安価です。
このガイドは、トークン効率を高めることは、全体的に使用量を減らすことではなく、使用するトークンを実際のタスクに確実に向けることだと強調しています。例えば、あるセッションでは、Claudeはテストとその対象ファイルを読み、編集し、数ターンで終了します。別のセッションでは、grepで周辺を検索し、同じ2つのファイルに到達するために十数個のファイルを読み、そのすべてのコンテキストを後続の各ターンに引きずり込み、コストがかかり、モデルが無関係なファイルについて考えることになります。
📖 全文を読む: HN AI Agents
👀 See Also

AIエージェント用語の実用用語集(ハーネス、スキャフォールド、エージェントなど)
Hugging Faceのブログによる、AIエージェント用語(Harness、Scaffold、Agentなど)をわかりやすく解説した用語集。実際の例を用いて説明しています。

Claude Code オーケストレーターが有用であるための4つの要素
Claude Codeでオーケストレーターエージェントを構築した開発者からの実践的アドバイス:ミッションドキュメント、ハートビート、エージェント間通信、監査可能な制御。

一汁一菜:应对AI疲劳的日本料理原则
Takuyaは、日本の料理原則「一汁一菜」をAI疲れ対策に応用。ご飯、汁物、一皿の食事のように、テクノロジースタックを主要ツール1つと補助ツール1つに絞る。

Claude Codeワークフロービジュアル: メモリ階層、スキル、フック、ループ
Redditの投稿で、Claude Codeのワークフロービジュアルが紹介されています。CLAUDE.mdのメモリ階層(グローバル→リポジトリ→スコープ)、.claude/skills/内の再利用可能なパターンとしてのスキル、推奨されるワークフローループ(計画→記述→承認→コミット)をカバーしています。