複雑な検索パイプラインをLLMエージェント向けのシンプルなgitシェルコマンドに置き換える

複雑なパイプラインからシンプルなシェルアクセスへ
チームは当初、バージョン履歴をコンテキストとして利用するAIエージェント向けのgitベースメモリシステム「DiffMem」を構築しました。その検索レイヤーでは、コサイン類似度スコアリングにsentence-transformers、キーワード検索にrank-bm25、クエリの蒸留と結果の統合に2段階LLMパイプラインを使用していました。これにより、3GBのDockerイメージ(PyTorch依存関係による)、ヘビーユーザーでの10%のタイムアウト率、毎回インメモリBM25インデックスを再構築するコールドスタートが発生していました。
気づき:LLMはすでにgitを知っている
Unixコマンドが、数十億のREADMEファイル、CIスクリプト、Stack Overflowの回答を通じてLLMのトレーニングデータに濃密に表現されていることに気づいたことが洞察につながりました。チームは、自分たちのコードでgitから情報を抽出し、すでにgitコマンドを理解しているモデルにそれを与えていることに気づきました。
解決策:1つのツール関数
彼らはすべてを単一のツールに置き換えました:
{
"name": "run",
"description": "メモリリポジトリで読み取り専用コマンドを実行する",
"parameters": {
"command": "シェルコマンド(|、&&、||、; の連結をサポート)"
}
}
エージェントの動作方法
エージェントは固定プロトコルに従います:エンティティマニフェストを読み、コミットログに対して時間的プローブを実行、調査を単一のツール呼び出しにバッチ処理、検索計画を出力、その後停止。コンテンツではなくポインタを返し、コンテキストを軽量に保ちます。
エージェントはターン中に軽量なシグナルを読み取ります:
- 構造確認のための
head -30 - キーワード検索のための
grep -n - 最近の変更確認のための
git diff HEAD~3..
実際の例:コミット履歴を通じた関連性の発見
ユーザーが孤独を感じていると述べた誕生日メッセージを送信したとき、エージェントは以下を実行しました:
git log --format='%h %ad' --date=relative --name-only -15
これにより、wife.mdとcompany.mdが同じセッションで変更され、重要な同僚が直近3セッションのうち2つに登場していることが明らかになりました。キーワード検索(BM25)では「誕生日に孤独を感じる」からcompany.mdを見つけることはできなかったでしょうが、git履歴の時間的関連性が重要だったのです。
ターン3では、エージェントはセミコロンで連結された9つのコマンドを含む単一のツール呼び出しを構成しました:
git diff HEAD~2.. -- memories/people/wife.md; git log --stat -5 -- memories/people/wife.md; head -30 memories/people/wife.md; grep -n "birthday|surgery|stress" memories/people/wife.md; tail -50 timeline/2026-03.md; git diff HEAD~3.. -- timeline/2026-03.md; grep -n "project|deliverable" memories/contexts/company.md; git diff HEAD~2.. -- memories/contexts/company.md; git diff HEAD~1.. -- memories/people/colleague.md
結果
最終出力は、特定のgit差分、優先度レベル、トークン見積もりを含むJSON検索計画でした。これにより、rank-bm25、sentence-transformers、scikit-learn、numpyの削除が可能になりました。Dockerイメージは約3GB減少し、サーバー起動が高速化、メモリ使用量が減少、10%のタイムアウト率が解消しました。残ったもの:requests、openai、gitpython。
📖 Read the full source: r/LocalLLaMA
👀 See Also

マニュアル駆動開発:クロードコードの自信過剰な逸脱を防ぐ方法
マニュアル駆動開発(MDD)は、Claude Codeにおける自信過剰な乖離に対処する手法です。AIが誤った前提に基づいて、自身のテストを通過する誤ったコードを生成する問題を解決します。本番環境監査では、MDDが190件の問題を発見し、8時間未満で876件の新規テストを作成し、ルール違反を排除しました。

Memento v1.0:AIコーディングエージェント向けローカル永続メモリ
Memento v1.0は、クラウド依存なしで埋め込み、ストレージ、検索をマシン上で実行する、AIコーディングエージェント向けの完全ローカルメモリレイヤーです。all-MiniLM-L6-v2埋め込みとHNSWインデックスを使用し、17のMCPツールで複数のIDEをサポートします。

NetflixがHugging FaceにVOID:ビデオオブジェクトおよびインタラクション削除モデルをリリース
Netflixは、落下する物体や移動したアイテムなど、それらが引き起こすすべての物理的相互作用とともに、ビデオからオブジェクトを除去するビデオインペインティングモデル「VOID」をリリースしました。このモデルには40GB以上のVRAMを搭載したGPUが必要で、異なる精緻化レベルに対応する2つのチェックポイントファイルを使用したクワッドマスク条件付けを採用しています。

開発者がKotlinマルチプラットフォームプロジェクト向けに実用的なClaudeスキルを作成
ある開発者が、既存のスキルが汎用的すぎる、特定のスタックに偏りすぎている、あるいは実用的でないと感じたため、Kotlin Multiplatform(KMP)作業に特化したClaudeスキルの公開リポジトリを作成しました。このスキルは、アーキテクチャレビュー、機能実装、モジュール化、Compose Multiplatform UI、ナビゲーション、プラットフォームブリッジ、ディープリンク、適応型UI、テスト、ビルドガバナンスなどをカバーしています。