agentcache: マルチエージェントLLMプレフィックスキャッシュのためのPythonライブラリ

agentcacheは、接頭辞キャッシュを中核機能として実装することで、マルチエージェントLLMシステムを最適化するために設計されたPythonライブラリです。このライブラリは、CrewAI、AutoGen、open-multi-agentなどのフレームワークが各ワーカーに対して新しいセッションを作成し、キャッシュヒットがゼロでプロンプトコストが重複するという一般的な問題に対処します。
仕組み
このライブラリは、別々のセッションを作成する代わりに、フォークベースのアプローチで動作します:
- 共有システムプロンプトで1つのセッションを開始
- 最初の呼び出しを行う - プロバイダーが接頭辞を計算してキャッシュ
- N個のワーカーが必要な場合、N個の新しいセッションを作成する代わりにフォーク
- 親セッション:[システム、メッセージ1、メッセージ2、...]
- フォークされたセッション:[システム、メッセージ1、メッセージ2、...、ワーカータスク]
- 完全に同じ接頭辞 = キャッシュヒット
主な機能
- キャッシュセーフなフォーク:ワーカーセッション間で同一の接頭辞を維持
- キャッシュブレーク検出:スナップショットを差分比較し、キャッシュヒット率が低下したときに正確に何が変更されたかを報告
- キャッシュセーフな圧縮:長時間実行されるセッションでは、各呼び出し前に古いツール出力をスキャンし、大きな結果を決定論的なプレースホルダーに置き換えて、より小さなコンテキストを維持しながらキャッシュ可能な接頭辞を保存
- パラメータ凍結:フォーク前にキャッシュ関連パラメータを凍結(システムプロンプト、モデル、ツール、メッセージ、推論設定)
- タスクDAGスケジューリング:1つのキャッシュされたセッションから並列ワーカーを可能にする
パフォーマンス結果
GPT-4o-miniでの直接比較テスト(コーディネーター + 3ワーカー、同じタスク):
- テキストインジェクション / 別々のセッション:0%キャッシュヒット、85.7秒
- 接頭辞フォーク:75.8%キャッシュヒット、37.4秒
- ワーカーごとのキャッシュヒット率は通常80-99%の範囲
インストールと使用方法
pipでインストール:
pip install "git+https://github.com/masteragentcoder/agentcache.git@main"
このライブラリはGitHubのgithub.com/masteragentcoder/agentcacheで利用可能です。
📖 Read the full source: r/LocalLLaMA
👀 See Also

Hermes Agent v0.6.0は、モデルごとのツール呼び出しパーサーによる強化されたローカルモデルサポートを提供します。
Nous ResearchによるHermes Agent v0.6.0は、30Bクラスのモデルで適切にツール呼び出しを処理するモデルごとのツールコールパーサーを提供し、Ollama、vLLM、sglangをすぐにサポートし、サーバーレス展開のためのModalやDaytonaを含む6つのターミナルバックエンドを備えています。

オープンソースのGmail MCPサーバーが、複数アカウント対応と書き込みアクセス機能を追加しました。
オープンソースのMCPサーバーにより、Claude AIが複数のGmailアカウントに接続し、アーカイブ、ラベル付け、自動購読解除機能を含む完全な読み書き機能を利用できるようになります。Gmail検索構文をサポートし、Railwayへの5分でのデプロイまたはセルフホスティングが可能です。

AIエージェントのための複雑な検索パイプラインを、シンプルなgitコマンドで置き換える
ある開発者が、3GBのDockerイメージを、AIエージェントがgit log、grep、git diffなどの読み取り専用シェルコマンドをメモリリポジトリで直接実行できる単一ツールに置き換えました。

Shipwright: Claude Codeを基盤に構築されたオープンソースプロジェクト管理ツール
Shipwrightは、44のスキル、7つの専門エージェント、16のワークフローを備え、Claude Code上で動作するオープンソースのプロジェクト管理ツールです。バイナリ品質ゲートとリカバリープレイブックを含み、エンジニアリング作業開始前に資格情報レジストリの監査や自動化プラットフォームの評価に使用されました。