エージェントリコール:永続的なClaudeコードメモリのためのローカルSQLite MCP

Claude Codeのセッションメモリ問題の解決
Claude Codeはセッション間ですべてを忘れてしまうため、ユーザーはチームの詳細、決定事項、障害などを毎回説明し直す必要があります。CLAUDE.mdは単一プロジェクトでは機能しますが、複数のプロジェクトにまたがるとコンテキストが競合し、煩雑になります。
agent-recallは、クラウド依存なしでセッション間で永続化するローカルSQLiteベースのメモリレイヤーでこの問題に対処します。
仕組み
- WALモードの単一SQLiteファイル - クラウド不要、ベクターデータベース不要、データはマシン外に出ません
- 作業中にClaudeがエンティティ、関係性、観察結果を保存できる9つのMCPツール
- セッション開始時、LLMが主要人物、最近の決定事項、アクティブな障害をカバーする構造化されたブリーフィングを生成し、生データのダンプは行いません
- バージョン管理されたスロット履歴 - 古い値は上書きされずにアーカイブされます
主な機能
自由形式のメモリに優れたclaude-memory-mcpと比較して、agent-recallは以下を提供します:
- 構造化データのためのエンティティ-関係モデル
- どのプロジェクトがどのコンテキストを見るかを制御するスコープ付き可視性
- 生の事実をコンテキストに読み込むのではなく、LLMで要約されたブリーフィング
セットアップ
インストールは簡単です:
pip install 'agent-recall[mcp]'その後、サーバーを.mcp.json設定ファイルに追加します。このツールはMITライセンスで、321のテストがあり、1日約30エージェントを運用する業務から開発されました。
著者は実装アプローチについて興味深い疑問を提起しています:LLMで要約されたブリーフィングは、実際に生の事実をコンテキストに読み込むよりも優れているのでしょうか?これは、MCPエコシステムにおける最適なメモリ管理戦略についての継続的な実験を反映しています。
📖 完全なソースを読む: r/ClaudeAI
👀 See Also

ログリデューサーMCPサーバーがClaudeコードのログ読み取り時のトークン使用量を削減
Log Reducerは、Claude Code向けに特別に構築されたMCPサーバーで、ログファイルをサーバー側で読み取り、会話には削減された出力のみを送信し、生のログがコンテキストウィンドウに入るのを防ぎます。開発者によると、2000行のログは、セッションから恒久的に削除される20,000以上のトークンを表しています。

ボデガ推論エンジン:Apple Siliconの統一メモリ向けLLM推論最適化
Bodegaは、Apple Siliconの統一メモリアーキテクチャに特化して構築された推論エンジンで、MLX向けの継続的バッチ処理とKVキャッシュ管理を再設計することでスループットの制限に対処しています。開発者は2.5年間かけてMetalレイヤーに近い最適化を行ったと報告しています。

スチールマン R5: 微調整された14BモデルがAdaコード生成でClaude Opusを上回る
開発者は、3,430のAda/SPARK命令ペアからなるコンパイラ検証済みデータセットを使用してQLoRAでQwen2.5-Coder-14B-Instructをファインチューニングし、カスタムベンチマークで68.6%のコンパイル率を達成しました。これはClaude Opus 4.6の42.1%を上回る結果です。このモデルはOllama経由で利用可能で、12GBのVRAMに収まります。

Models.dev: AIモデルの仕様、価格、性能に関するオープンソースデータベース
Models.devは、コミュニティが貢献するオープンソースのAIモデル仕様・価格・機能データベースです。APIとTOMLベースの定義を提供します。