シングルコールMCPパイプラインにより、Claude Codeのトークン使用量を74%削減

開発者が、Claude Codeにコードベースの依存関係グラフを提供するコンテキストエンジン(MCPサーバー)を構築した経験を共有しました。これにより、ファイル全体ではなく関連するコードのみを読み取ることが可能になりました。このツールは、生のファイルではなく依存関係グラフとスケルトンを提供することで、トークン使用量を大幅に削減します。
元の問題と初期の解決策
Claude Codeは通常、ファイル全体を読み取り、すべてをコンテキストにダンプするため、トークンを急速に消費していました。初期のアプローチでは、生のファイルではなく依存関係グラフとスケルトンをMCP経由で提供することで関連コードのみを提供し、これだけでトークン使用量を65%削減しました。
特定された非効率性と解決策
ユーザーは、MCPワークフロー自体が無駄であると指摘しました。エージェントが複数回の往復を行っていたのです:get_context_capsuleを呼び出し、結果を読み取り、次にget_impact_graphを呼び出し、その結果を読み取り、その後search_memoryを呼び出し、その結果を読み取るという流れでした。これにより、コンテキスト内で結果が重複する3回の往復が発生していました。
run_pipelineによる修正
開発者は、run_pipelineというシングルコールのMCPツールをリリースし、多段階のワークフローを置き換えました。このツールは意図(デバッグ/修正/リファクタリング/探索)を自動検出し、適切なコンテキスト検索、影響分析、メモリ呼び出しの組み合わせをサーバー側で実行します。
run_pipeline({
task: "JWT検証バグの修正",
preset: "auto",
max_tokens: 10000,
observation: "JWTはEd25519を使用" // 同じ呼び出しで洞察を保存
})
この単一の呼び出しは、3〜4回の個別呼び出しを置き換えます。結果は重複排除され、トークン予算内で統合されてからコンテキストウィンドウに到達するため、ツールを個別に呼び出す場合と比べて約60%少ないコンテキストトークンで済みます。observationパラメータにより、エージェントは別途save_observationステップを踏むことなく、同じ呼び出しで学習した情報を保存できます。メモリはコードグラフノードにリンクされているため、コードが変更されると観察結果は自動的に古いものとしてフラグが立てられます。
追加でリリースされた機能
- パッシブ観察パイプライン:ファイルウォッチャー → blake3ハッシュ差分 → ASTレベルの構造的差分 → ツール呼び出しとの自動相関 → ゼロ設定の観察
- VS Codeなしで動作するCLI:
npm install -g vexp-cli - 既存のものを上書きしないGitフック(マーカー区切りブロック)
- VS Codeサイドバーに表示されるトークン節約表示(24時間ローリングウィンドウでの実際の数値)
利用可能性
このツールは無料で試すことができ、2,000ノード、基本的なパイプライン機能、完全なセッションメモリを提供する寛大な無料ティアを提供しています。アカウントやAPIキーは不要で、ネットワーク呼び出しは一切行いません。コアアーキテクチャには、開発者が構築したRustグラフエンジンとtree-sitterパーサーが含まれており、Claude CodeはMCPプロトコル層、SQLiteスキーママイグレーション、エージェント指示テンプレートの作成を支援しています。
📖 完全なソースを読む: r/ClaudeAI
👀 See Also

OpenClaw統合によるインド株式市場:マルチエージェント分析と取引端末
インド市場向けのオープンソース取引端末がOpenClawスキルサーバーとして接続され、どのOpenClawエージェントでもローカルインストールなしでHTTP経由でインド株式市場データを取得し、完全な分析を実行できるようになりました。このシステムは7つの専門エージェントを並列で動作させ、取引計画を含む構造化された分析を生成します。

ローカルファーストのAI税務申告ソフトウェア、MCP上に構築された暗号化された個人識別情報(PII)対応
開発者がCrow向けに納税申告拡張機能を構築しました。このシステムはすべての個人識別情報(PII)をAES-256-GCMで暗号化し、Claude、ChatGPT、Gemini、Ollama経由のローカルモデルを含むあらゆるMCP互換クライアントで動作します。システムは1040フォーム、スケジュール1、HSA(8889)、教育費控除(8863)、自営業(スケジュールC/SE)、キャピタルゲイン(スケジュールD)の計算をローカルで処理します。
MTP + ユニファイドメモリがRTX 5090でllama.cpp推論を30%高速化
GGML_CUDA_ENABLE_UNIFIED_MEMORY=1 と MTP 推測を併用すると、128GB システム RAM を搭載した RTX 5090 上で Qwen3.6-27B Q8_0 のスループットが 49 tok/sec から 64 tok/sec に向上します。

log-context-mcp: MCPツールはClaudeデバッグ時のログトークン使用量を96%削減します
log-context-mcpは、デバッグセッション中に冗長なログファイルでClaude Codeがトークンを消費する問題に対処するために構築されたMCP(Model Context Protocol)ツールです。ログファイルがClaudeのコンテキストに到達する前に前処理を行い、重複行の排除、スタックトレースのグループ化、ノイズの除去を行ってトークン使用量を削減します。2000行のApacheログでのテストでは、96.5%の削減率を示しながら、根本原因を正しく特定しました。