ローカルLLMをClaudeコードサブエージェントとして使用してコンテキスト使用量を削減する

Claude Codeは、Claudeのサブエージェントを使用する方法と同様に、ローカルLLMにタスクを委譲することで作業を調整できます。このアプローチにより、ファイルの内容はClaudeのコンテキストから除外され、ローカルモデルの要約と洞察のみが返されます。
仕組み
小さなPythonスクリプト(約120行、標準ライブラリのみ)がエージェントループを実行します:
- ファイルの内容なしでClaudeにタスクの説明を渡します
- スクリプトは
read_fileとlist_dirツール定義を含めて、LM Studioの/v1/chat/completionsエンドポイントに送信します - ローカルモデルは必要なファイルを読み取るためにそれらのツールを自ら呼び出します
- 最終的な回答が生成されるまでループが続きます
- Claudeは結果のみを確認します
コマンド例:
python3 agent_lm.py --dir /path/to/project "summarize solar-system.html"
これにより以下が生成されます:
- [ターン1] →
read_file({'path': 'solar-system.html'}) - [ターン2] → このHTMLファイルはインタラクティブなアニメーション太陽系を作成します...
ファイルの内容はClaudeのコンテキストではなく、ローカルモデルのコンテキスト(Qwenのコンテキストでテスト済み)に入ります。
ユースケースと制限事項
Apple Silicon上のMLXを介したQwen3.5 35B 4-bitでのテストに基づくと、このアプローチは以下に適しています:
- コードの要約と説明
- バグの発見
- ボイラープレート/初稿の生成
- テキストの変換と翻訳(ヘブライ語でテスト済み)
- 論理タスクと推論(難しい問題には
--thinkフラグを使用)
以下には適していません:
- Claudeの完全なコンテキストを必要とするタスク
- 関係性が重要なマルチファイル理解
- 現在の会話履歴を必要とするタスク
- 正確性が重要なもの
これをClaudeの代替ではなく、Haikuレベルのアシスタントと考えてください。
セットアップ要件
- APIサーバーが有効な状態でローカルで実行されているLM Studio
- エージェントループ用のPythonスクリプト1つ、シンプルなプロンプトのみのクエリ用のスクリプト1つ
- 両方をグローバルな
~/.claude/CLAUDE.mdに接続し、Claude Codeが関連する時に委譲を提供するようにします - MCPサーバー、pip依存関係、プラグインインフラは不要です
設定のヒント:Jinjaテンプレートの先頭に{%- set enable_thinking = false %}を追加します。ほとんどのタスクでは、ローカルモデルに推論させる必要はなく、これにより時間とトークンを節約し、速度を向上させ、そのようなタスクでは品質の低下はほとんどありません。
📖 完全なソースを読む: r/ClaudeAI
👀 See Also

ピコクロー、F1 AIエージェントの構築に失敗、APIクレジットで20ドルを浪費
ある開発者が、Raspberry Pi Zero 2WでPicoClawを使用してF1情報ボットを構築しようと試みましたが、ツールはバージョン11にデフォルト設定され、誤ったPythonコードを生成し、DeepSeek APIクレジットを20ドル消費したにもかかわらず、動作するソリューションを生み出すことができませんでした。

ClawCut ProxyがGitHubで公開され、小規模LLM向けにOpenClawを最適化
ClawCutは実験的なプロキシで、OpenClawからのJSON呼び出しを操作・注入し、JSONの不要な部分を抽出することで、限られたハードウェア上で動作する小規模モデル(7B-8B)の認知的負荷を軽減します。

ユーザーが報告するOpenClawとClawDBotの評価は賛否両論:知っておくべきポイント
OpenClawとClawDBotは、コード自動化の有望なAIツールですが、一部のユーザーには期待外れの結果となっています。本記事では、これらのプラットフォームに関するユーザー体験と価値についてのRedditディスカッションから得られた重要な洞察を探ります。

ReasonDB: ベクトル検索ではなくLLM誘導ツリーナビゲーションを使用するオープンソースドキュメントデータベース
ReasonDBは、ドキュメント構造を階層として保持し、ベクトル検索の代わりにLLMガイドによるツリートラバーサルを検索に使用するオープンソースのドキュメントデータベースです。初期検索にはBM25を使用し、構造フィルタリングにはtree-grepを使用し、LLMが数百万ノードのうち約25ノードを訪問するビームサーチトラバーサルを採用しています。