オープンソースのローカルフックが自動的にClaudeモデルを切り替え、AIコストを削減します

開発者が、コーディングタスクの種類に基づいて最もコスト効率の高いClaude AIモデルを自動的に選択するローカルフックをオープンソース化しました。品質を損なうことなくAIコストを50〜70%削減する可能性があります。
仕組み
このツールは、各プロンプトが送信される前に、CursorとClaude Code(両方とも同じフックシステムを使用)でローカルフックとして実行されます。Opus/planの隣に位置し、高価なモデルに到達する前に明らかに不適切なモデルマッチを防ぐ効率的なフロントエンドフィルターとして機能します。
主な機能
- プロンプトと現在のモデル選択を読み取る
- シンプルなキーワードルールを使用してタスクを分類(git操作、機能開発、アーキテクチャ/詳細分析)
- 過剰な支払い(例:gitコミットにOpusを使用)をブロックし、HaikuまたはSonnetを提案
- 性能不足(アーキテクチャにSonnet/Haikuを使用)をブロックし、Opusを提案
- それ以外はすべて変更せずに通過させる
- ! プレフィックスで提案に同意しない場合、フィルターを完全にバイパス
技術詳細
- 3つのファイル:bash + python3 + JSON
- プロキシなし、API呼び出しなし、外部サービスなし
- フェイルオープン設計:ハングアップしてもClaude Codeは通常通り進行
- オープンソース化:https://github.com/coyvalyss1/model-matchmaker
性能とテスト
開発者は数週間にわたる自身のプロンプトを分析し、以下を発見しました:
- 60〜70%は標準的な機能開発で、Sonnetが処理可能
- 5〜20%はデバッグ/トラブルシューティング
- かなりの部分は純粋なgit/リネーム/フォーマットタスクで、Haikuが90%低コストで同等に処理
遡及分析では、このツールが品質低下なしにAI支出の50〜70%を削減したことが示されました。調整後、実際のテストプロンプト12件中12件を正しく処理しました。
解決する問題
問題は知識ではなく(開発者はモデルを切り替えるべきことを知っています)、摩擦です。フロー状態にある開発者は、ドロップダウンメニューについて考えたくありません。このツールは意思決定プロセスを自動化します。
📖 全文を読む: r/ClaudeAI
👀 See Also

Constrails:AIエージェント向け早期アルファ版外部ガバナンスレイヤー
Constrailsは、AIエージェント向けの外部ランタイムガバナンスレイヤーであり、エージェントとそのツールの間に制御層を配置することで、機能チェック、リスクスコアリング、ポリシー評価、監査ログ記録を実装します。この初期アルファ版プロジェクトは、制御をエージェント自体の外部に移すことで安全性の問題に対処することを目指しています。

V6rge AI SuiteアップデートでNVIDIA GPUサポートとベータ版コーディングエージェントを追加
V6rge AI Suiteがアップデートされ、GPU検出の問題を修正し、パフォーマンス向上のための完全なNVIDIA GPUサポートを追加、さらにアプリ内で直接コードを生成・支援する新しいベータ版コーディングエージェントを導入しました。

パイロットプロトコル:AIエージェントスウォームのためのオープンソースP2Pネットワークスタック
Pilot Protocolは、AIエージェント間通信のために特別に設計されたオープンソースのレイヤー3およびレイヤー4オーバーレイネットワークスタックで、エージェント間の直接暗号化UDPトンネルと永続的な48ビット仮想アドレスを提供します。

オリー・ルーメン:Claude Code用オープンソースローカルセマンティック検索プラグイン
Ory Lumenは、Claude Codeのパフォーマンス問題を解決するためのプラグインです。Ollamaのコード埋め込みモデルとSQLite-vecのセマンティック検索を使用してコードベースをインデックス化し、大規模なコードベースでのClaude Codeの性能問題に対処します。このツールは無料でローカルのみ動作し、再現可能な結果を得るためのSWEスタイルのベンチマークテストハーネスを含んでいます。