mnemos: AIコーディングエージェント向け永続メモリ層(Go、MCPネイティブ、Python不要)

✍️ OpenClawRadar📅 公開日: May 8, 2026🔗 Source
mnemos: AIコーディングエージェント向け永続メモリ層(Go、MCPネイティブ、Python不要)
Ad

mnemosは、AIコーディングエージェントのための永続メモリレイヤーで、単一の静的Goバイナリ(約15MB)として構築されており、Python、Docker、CGOは不要です。純粋なGo SQLiteをmodernc.org/sqlite経由で使用し、ハイブリッド検索(BM25 + RRFによるベクトル)を提供し、必要に応じてOllamaで埋め込みを生成します。MCPネイティブで、Claude Code、Cursor、Windsurf、Codex CLIに対応しています。

ベリファイアとベンチマーク

著者は、同じエージェントをmnemosありとなしで同じプロンプトとモデルの下で2回実行し、具体的な効果を測定するベリファイアを構築しました。バイナリには3つの検証モードが含まれています:

  • mnemos verify retrieval – 適切なメモリがトリガークエリに対して表面化するかをチェック
  • mnemos verify behavior – Claudeをmnemosオン・オフで実行し、トランスクリプトがアサーションと一致する頻度をカウント
  • mnemos verify capture – エージェントがタスク中に与えられた修正を記録するかをチェック

読み取り側の結果(Claude Codeでのn=5ペア実行):

  • session_start_on_edit: あり5/5、なし0/5(+100%)
  • oss_first_for_protocol: あり5/5、なし0/5(+100%)
  • no_ai_attribution_in_commit: 5/5 vs 5/5(効果なし)
  • no_cgo_proposal: 5/5 vs 5/5(効果なし)
  • migration_locked_refused: 5/5 vs 5/5(効果なし)

全体で+40%。モデルの事前知識が誤っているか存在しない場合(異例の慣習、再帰的なツールメモリなど)にメモリが効果を発揮します。広く知られたベストプラクティスでは効果はありませんが、劣化も見られません。

Ad

書き込み側のキャプチャ

初期ベースラインでは、エージェントはタスク中に与えられた修正のわずか7%しか記録しませんでした。「今後のセッションのために保存」は3回中3回スキップされました。2回の修正ラウンドの後、キャプチャ率は53%に達しました。

  • ラウンド1(ツール記述の微調整): 「Xを試した」「今後はYを使用」などのトリガーフレーズ例を追加。7%から13%に向上(ノイズレベル)。
  • ラウンド2(構造的修正): UserPromptSubmitフックを追加し、修正を示すフレーズをパターンマッチングし、プロンプトコンテキストにディレクティブブロックを挿入。エージェントが構造化ツールコールを実行するのは変わらないが、トリガーはスキップ不可に。13%から53%に向上。

残る失敗パターン:大規模なタスクプロンプトに埋もれたアーキテクチャ上の決定は、ディレクティブがあっても3回中0回。より強いタスクフレーミングがそれを上書きしているようです。

技術スペック

  • 単一の静的Goバイナリ、約15MB
  • 純粋なGo SQLite via modernc.org/sqlite
  • ハイブリッド検索:BM25 + RRFによるベクトル、Ollamaを自動検出、なくても正常動作
  • MCPネイティブ:Claude Code、Cursor、Windsurf、Codex CLIで動作
  • バイテンポラルストア、書き込み境界でのプロンプトインジェクションスキャナー、決定的な修正からスキルへの昇格(統合ループにLLM不使用)
  • ローカルファースト:明示的にOpenAIを埋め込みに指定しない限り、データはマシン外に出ません

ベリファイアハーネス

ベリファイアはリポジトリのverify/にあります。フィクスチャはYAMLで、シナリオの追加は簡単です。著者はn=5は少ないと述べており、次にtau-bench pass@kベンチマークに取り組んでいます。

リポジトリ:https://github.com/polyxmedia/mnemos

📖 元の記事を読む: r/LocalLLaMA

Ad

👀 See Also

SQLite知識ストアとMCPツールを使用したAIコンテキストの管理
Tools

SQLite知識ストアとMCPツールを使用したAIコンテキストの管理

ある開発者がRunawayContext(MITライセンス)を構築しました。これはプロジェクトの教訓をSQLite(FTS5、オプションでsqlite-vec)に保存し、MCPクエリツールとハードコードされた上限を使って、セッションごとのコンテキストを3Kトークン未満に抑えるシステムです。

OpenClawRadar
Arena AIモデルELO履歴が経時的なLLM性能低下を追跡
Tools

Arena AIモデルELO履歴が経時的なLLM性能低下を追跡

ライブダッシュボードは主要AI研究所のフラッグシップモデルのELOレーティングを可視化し、段階的なパフォーマンス低下と新リリース時の急上昇を明らかにします。このツールは研究所ごとに1本の曲線を動的にプロットし、最高評価のモデルを追跡します。

OpenClawRadar
アウレリウス:48のクロードコードエージェントとFigma-to-Reactパイプラインで構築されたReactフレームワーク
Tools

アウレリウス:48のクロードコードエージェントとFigma-to-Reactパイプラインで構築されたReactフレームワーク

Aureliusは、FigmaデザインからReactアプリケーションを自律的に構築するために、階層的に組織された48のClaude Codeエージェントを使用するオープンソースのReactフレームワークです。このフレームワークは、デプロイ前にTDD、ピクセル差分比較によるビジュアルQA、および品質ゲートを強制します。

OpenClawRadar
OpenClaw Alexa Voice Proxyは双方向音声インタラクションを可能にします
Tools

OpenClaw Alexa Voice Proxyは双方向音声インタラクションを可能にします

openclaw-alexa-voiceは、AlexaカスタムスキルをOpenClawゲートウェイに接続するNode.jsプロキシで、音声クエリに対して3段階の応答システムを実装しています。1秒未満の高速応答、12秒未満のエージェント応答、2分以内に非同期処理される遅延複雑クエリを処理します。

OpenClawRadar