永続的なローカルAIコンパニオンエージェント構築からの実践的教訓

✍️ OpenClawRadar📅 公開日: March 24, 2026🔗 Source
永続的なローカルAIコンパニオンエージェント構築からの実践的教訓
Ad

セットアップとアーキテクチャ

開発者がM4 Mac mini上でセルフホスト型AIエージェントを数ヶ月間運用している。このセットアップでは、高速なローカル推論のためにOllama上でqwen2.5:14bをRustランタイムで使用している。システムはモデルラダーを実装しており、タスクにより高い能力を必要とする場合にはクラウドモデルにエスカレートする。メモリはSQLiteで管理され、セッションをまたいだ意味的検索のためにnomic-embed-textを使用したローカル埋め込みが行われる。エージェントはlaunchd経由で24時間稼働し、トレーディングボットの監視、メールチェック、ウェブサイトのデプロイ、タスクランナーを介したClaude Codeへの重い実装作業の委任など、様々なタスクを実行する。

Ad

得られた主な教訓

メモリ・アーキテクチャが全てを決める: 開発者は、BM25キーワード検索とベクトル類似性を重み付けして統合するハイブリッド検索が画期的であることを発見した。優れたメモリ検索機能を持つ14Bモデルは、毎回の会話をゼロから始める70Bモデルよりも優れたパフォーマンスを発揮する。

システムプロンプトのコストは現実的: 初期のアイデンティティファイルは約10Kトークンから始まったが、エージェントが必要に応じて参照できるものは全て削減し、約2,800トークンまで縮小された。ルールは次の通り:エージェントが時々必要とするものはメモリに保存し、毎回のメッセージで必要とするものはシステムプロンプトに含める。

ローカル埋め込みが経済性を変えた: 会話モデルと並行してOllama上でnomic-embed-textを使用することで、すべてのメモリ保存と検索操作が無料になり、以前はOpenAIの埋め込みリクエストから蓄積されていたコストが解消された。

デフォルトモデルよりもモデルラダーが重要: エージェントは会話にはローカルのqwenをデフォルトで使用する(無料、高速)が、タスクの要件に応じてMinimax、Kimi、Haiku、Sonnet、Opusにエスカレートできる。重要な洞察:自動検出を試みるのではなく、推論タスクには/model sonnet、チャットには/model qwenといったコマンドで人間が手動でモデルを切り替えられるようにすること。

ツール反復回数の制限には余裕が必要: メッセージあたり最大10回のツール呼び出しから始めたが不十分だったことが判明。単純なタスクでは3〜5回のツール呼び出しを消費し、複雑なタスクでは15〜20回が必要となる。現在のセットアップでは、安全策として1時間あたり200アクションのレート制限とともに25回のツール呼び出しを使用している。

最も困難なバグはセッション間メモリだった: storeツールを介して明示的に保存されたメモリには当初session_idがなく、検索クエリは現在のsession_idでフィルタリングされていた。これにより、意図的に記憶された事実が将来のセッションで見えなくなっていた。修正方法は、SQLクエリにOR session_id IS NULLを追加することだった。

📖 元記事を読む: r/LocalLLaMA

Ad

👀 See Also

ClaudeとMCPを活用したコンテンツ制作・公開ワークフロー
Use Cases

ClaudeとMCPを活用したコンテンツ制作・公開ワークフロー

開発者がMCP統合を介してClaudeを出版プラットフォームとして使用する方法を説明し、チャットインターフェースを離れることなく記事の作成、編集、公開を可能にしています。ワークフローには下書き作成、リンク追加、公開スケジューリング、既存コンテンツの更新が含まれます。

OpenClawRadar
SDRは、AI生成ビデオフォローアップで冷めたD2C見込み客を再エンゲージ
Use Cases

SDRは、AI生成ビデオフォローアップで冷めたD2C見込み客を再エンゲージ

D2Cブランド向けSaaS企業のSDRが、テキストメールの代わりにAI生成ビデオによるフォローアップを使用して成功を報告。ワークフローは、Claudeでプロンプトを記述し、Magic Hourでビデオを生成し、必要に応じてElevenLabsでボイスオーバーを仕上げるというもの。

OpenClawRadar
13エージェントのクロードチームを構築し、ピアレビューワークフローを導入
Use Cases

13エージェントのクロードチームを構築し、ピアレビューワークフローを導入

ある開発者が、AIビデオ生成プラットフォーム「Fruityo」のマーケティングを担当する13体のClaudeエージェントチームの構築方法を共有しました。このシステムは15分ごとに実行され、人間のオペレーターに届く前にエージェント同士が互いの作業をレビューします。

OpenClawRadar
Claude Projects + Gamma Connector: $12K MRR SaaS創業者による12分の投資家向けアップデート
Use Cases

Claude Projects + Gamma Connector: $12K MRR SaaS創業者による12分の投資家向けアップデート

インドの家庭教師向けSaaSを運営する創業者(MRR 12,000ドル)が、Claude Projects(永続的コンテキスト)とGammaコネクタを使って、投資家向けアップデートの作成時間を3時間から12分に短縮した方法。

OpenClawRadar