LightMem:LLMエージェント向け軽量メモリシステム、10倍以上の性能向上と100分の1のコストを実現

LightMem: LLMエージェントのための実用的なメモリレイヤー
LightMemは、LLMエージェント向けの軽量でモジュラー型のメモリシステムです。長いマルチターン対話において、コンテキストがノイズやコストの増加に悩まされ、モデルが「途中で迷子になる」問題や、既存のメモリシステムが遅延とトークンコストを増加させる課題に対処します。
LightMemの仕組み
本システムは、3つの主要なメカニズムを通じて、コンパクトでトピック指向の一貫性のあるメモリを維持します:
- 事前圧縮感覚記憶: 保存前に冗長で価値の低いトークンをフィルタリング
- トピック対応短期記憶: トピックごとにターンをクラスタリングし、精密なメモリユニットに要約
- 睡眠時間長期統合: 実行時の増分挿入と、遅延影響なしのオフライン高忠実度更新を活用
性能結果
LongMemEvalベンチマークにおいて、LightMemは以下の結果を示しています:
- 精度向上:最大約10.9%
- トークン削減:最大117倍
- API呼び出し削減:最大159倍
- 実行時間削減:12倍以上
最近の更新と機能
- LoCoMo & LongMemEvalにおけるメモリシステム(Mem0、A-MEM、LangMem)のベースライン評価フレームワーク
- 複数シナリオ向けデモ動画とチュートリアルノートブック
- マルチツールメモリ呼び出しのためのMCPサーバー統合
- 完全なLoCoMoデータセットサポート
- 再現可能なスクリプトによるGLM-4.6統合
- 自動ロード機能付きOllama、vLLM、Transformersによるローカルデプロイメント
位置付けとユースケース
LightMemは、以下のような様々なエージェントスタックと統合可能なモジュラー型メモリレイヤーとして設計されています:
- 長文脈エージェント
- ツール使用エージェント
- 自律ワークフロー
- 会話システム
本システムは、トークン数の爆発的増加なしにスケールする構造化メモリを提供し、エージェントフレームワーク、メモリ/RAGシステム、長文脈モデル、応用LLMチームで作業する開発者に特に有用です。
入手方法
論文:https://arxiv.org/abs/2510.18866
コード:https://github.com/zjunlp/LightMem
📖 完全なソースを読む: r/LocalLLaMA
👀 See Also

オープンソースの知識ベースサーバーと永続的AIメモリのためのマルチエージェントオーケストレーター
ある開発者が、カスタムMCPサーバーをプライベートVPS上に構築し、Claude、Codex、Geminiにセッションを超えた永続的なメモリを提供しました。このシステムには、Obsidianボールトを取り込むナレッジベースサーバーと、フェイルオーバー用のマルチエージェントオーケストレーター「Daniel」が含まれています。

フラヴィアン:24の専門クロードコードエージェントを備えたWordPress開発フレームワーク
Flavianは、Claude Codeを中心に構築されたオープンソースのWordPress開発フレームワークで、フロントエンド開発、セキュリティ監査、FigmaからWordPressへの変換などのタスクに対応する24の専門エージェントを備えています。作成者は、WordPress開発においてドメイン固有のエージェントが汎用エージェントを大幅に上回ることを発見しました。

Slackプラグイン for Claude Code:コンテキストと更新情報をSlackに接続
Slackは、検索、メッセージング、ドキュメント作成のためにSlackに接続できるClaude Code向けの新しいプラグインをリリースしました。このプラグインにより、Claude CodeはSlackのコンテキストにアクセスして技術的な問題を解決し、更新情報を投稿できるようになります。

Maestro v1.5.0は、マルチエージェントオーケストレーションのためのClaude Codeサポートを追加します。
オープンソースのマルチエージェントオーケストレーションプラットフォーム「Maestro v1.5.0」は、Gemini CLIに加えてClaude Code上でもネイティブプラグインとして動作するようになりました。今回のアップデートには、より深い設計計画、42ステップのオーケストレーションバックボーン、エージェント能力の強制適用、セキュリティ強化などが含まれています。