Claude Codeの請求を節約:計画トークンを低価格モデルにルーティング

Redditのユーザーが先月、Claude Codeでトークン使用量をモデル間で分割することで、超過料金を約40ドル節約したと報告している。重要なポイントは、計画段階(特に複数ファイルのリファクタリング)でトークン予算の最大80%を消費する可能性があるが、ほとんどの計画立案に最も高価なモデルは必要ないということだ。
仕組み
ユーザーは30行のラッパーを作成し、「何を変更すべきか」を考える初期作業を、より安価なモデルであるHaiku 3.5にルーティングした。実際の編集や意思決定のみをOpusまたはSonnetに残した。セットアップには約2時間かかり、どのステップを委任する価値があるかの判断も含まれる。
結果
前回のサイクルでは、4ヶ月ぶりに予算に余裕ができた。ユーザーは通常の2日間のリセット待ちを回避できた。節約額は約40ドルの超過料金である。
# ラッパーのロジックの擬似コード:
# 1. 計画プロンプトをhaiku-3.5に送信
# 2. ファイルと変更点のリストを受け取る
# 3. 計画と指示をopus/sonnetに渡して実際の編集を実行
注意点
アーキテクチャの決定において、Haikuの計画品質は明らかに劣る。Opusが実際の決定を引き継ぐリファクタリングとテストのワークフローでは問題ない。新規設計(「このアプリはそもそも何であるべきか」)の場合、ユーザーは依然としてOpusに最初から計画を任せている。
ユーザーは、このパターンは「OpenRouterのモデル価格表を見たことがある人ならおそらく明らか」と指摘するが、Claude Codeのサブエージェントドキュメントにはこの正確なアプローチに関する記述が少ない。
📖 出典全文: r/ClaudeAI
👀 See Also

2026年のAIモデルへのプロンプト方法:1年前から変わった3つの重要なポイント
ある開発者が、プロンプトテンプレートから再利用可能なスキルへの切り替え、ステップごとの指示ではなく目標を書くこと、Claude CodeとCodexで/longループコマンドを使用することの3つの具体的な変化を共有しています。
DeepSeek Flash出力のリレースエンドポイント改変を修正する方法
OpenRouterのRelaceエンドポイントのバグにより、DeepSeek V4 Flashの出力が静かに破損し、特に非英語のテキストで顕著でした。OpenClawの無視リストを介してプロバイダーを強制することで修正できます。

Claudeのプロジェクト指示が注入される仕組み—そして会話中に変更すると履歴が壊れる理由
プロジェクトの指示とユーザー設定は会話開始時にシステムプロンプトに読み込まれ、毎回再注入されるわけではありません。会話の途中で変更すると、Claudeは過去の指示の記憶を上書きし、誤った記憶を再生する原因となります。

OpenClawがAPIコスト修正とローカルモデルツールの改善を実施
OpenClawは、API利用コストへの対応とローカルモデルツール連携の改善を含む重要なアップデートを実施し、開発者体験と運用効率を向上させました。