エングラムメモリSDK:ローカルモデル搭載AIエージェント向けグラフベースメモリ

ローカルAIモデル向けグラフメモリSDK
Engram Memory SDKは、LiteLLM統合を介してローカルモデルと連携するAIエージェント向けに設計されたオープンソースのグラフメモリシステムです。コアアーキテクチャは取り込みと呼び出しを分離しており、エンティティと関係性を抽出するためのLLMは取り込み時に1回のみ必要です。一方、想起は純粋なベクトル検索、グラフトラバーサル、スコアリングによって動作し、追加のLLM呼び出しを必要としません。
技術詳細
このSDKは非同期Pythonで構築され、バックエンドデータベースとしてNeo4jを使用しています。ソースによると、取り込み操作あたり平均〜735トークンを処理し、95msの想起レイテンシを達成しています。システムには、バックグラウンドで実行される減衰とクラスタリングを備えた自己再構築メモリ機能が含まれています。
セットアップとインストール
インストールは簡単です:
pip install engram-memory-sdk設定には、以下の変数を含む.envファイルが必要です:
LLM_MODEL=ollama/llama3 # またはLiteLLMがサポートする任意のローカルモデル
NEO4J_URI=bolt://localhost:7687このシステムは、Ollama、vLLM、text-generation-webuiを介したローカルデプロイメントを含む、LiteLLMを介したあらゆるモデルをサポートしています。主な利点はコスト効率です:小さなローカルモデルで抽出を処理するため、継続的な想起操作はLLMトークンを消費しないため、文字通り$0のコストで実行できます。
📖 Read the full source: r/LocalLLaMA
👀 See Also

ビットチャット:AIエージェントがメッセージングプラットフォーム経由でライトニングネットワークでビットコインを送信可能
Bit-Chatという仕組みにより、AIエージェントはメール、WhatsApp、Telegram、Signalを介してライトニングネットワーク上でビットコイン支払いを送信できます。エージェントは[email protected]のような専用アドレスを生成でき、受信者が登録されていなくても支払いが機能します。

GLM-5.1対MiniMax M2.7:AIコーディングエージェントの性能比較
GLM-5.1はSWE-bench-Verifiedで77.8、Terminal Bench 2.0で56.2のスコアを達成し、オープンソースモデルの中で最高の性能を示しています。一方、MiniMax M2.7は低いTTFTと高いスループットで高速な応答を実現し、CIボットやバッチ編集に最適です。

ソース管理されたPRレビューにAIチェックを導入する
Continueは、マークダウンファイルをソース管理されたチェックとして使用し、GitHubのステータスチェックを通じて表示されることで、プルリクエストのワークフローに直接AIチェックを統合します。

Org Studio: マルチエージェントAIチームを管理するためのオープンソースダッシュボード
Org Studioは、組織設計の原則を適用してAIエージェントのチームを調整するオープンソースのダッシュボードで、OpenClawとHermes Agentの両方のランタイムをネイティブでサポートしています。チームトポロジー管理、イベント駆動型タスクボード、タスクコメントでエージェント同士が互いにメンションできるクロスランタイム通信などの機能を備えています。