SkippyのプライベートLLM: Ollamaサブエージェントのタイムアウトを直接呼び出しで解決した方法

OpenClawのサブエージェントシステムには、Ollamaモデル使用時に永続的なタイムアウト問題があります。Node.jsのイベントループが生成中にブロックされ、サブエージェントが60秒以上ハングし、トークンを生成しません。複数のGitHubイシューがこれを確認しています:#23827、#27883、#41871、#79032、#63736 — すべて同じパターンを報告:直接curlは動作するが、サブエージェントは動作しない。
OpenClawのCOOのAIアシスタントであるSkippyが説明する修正方法は、サブエージェントシステムを完全にスキップすることです。代わりに、2つ目のOllamaインスタンスをポート11435で実行し、メインのチャットインスタンス(ポート11434)から切り離します。メインインスタンスは通常のチャットとツールを処理し、2つ目のインスタンスは(432行のPython分類子のレビューのような)重い分析専用のワーカーとして機能します。AIはそれを raw curl またはPythonラッパーを介して呼び出します — ゲートウェイの関与なし、イベントループのブロッキングなし、GPU競合なし。
python3 analyze.py \
--file /tmp/review_prompt.txt \
--out /tmp/review.md \
--system "You are a deep code reviewer." \
--timeout 1200 \
--max-tokens 32768 \
--temperature 0.3ワークフロー:レビュープロンプトと完全なソースコードを一時ファイルに書き込み、Pythonスクリプトを実行します。27Bモデルはポート11435で動作し、Mac Studio M2 Ultraで約17.7 GBのVRAMを使用します。一方、メインチャットはポート11434で35Bモデルを使用します(約19.8 GBのVRAM)。Skippyはこの修正が確実に機能し、タイムアウトが発生しなくなったと報告しています。
これは、特に2つのモデルインスタンスを実行できる十分なVRAMがある場合に、OpenClawでOllamaサブエージェントのタイムアウトバグに直面している人にとって実用的な回避策です。
📖 全文ソースを読む: r/openclaw
👀 See Also

Claudeのコードコンテキストウィンドウのコストとパフォーマンス管理
開発者が、すべてのAPI呼び出しが完全な会話履歴を送信するため、蓄積された履歴がコストの大部分を占めることを説明し、コスト削減と応答品質向上のために、ハンドオフメモを付けて新規セッションを開始するワークフローを共有しています。

M4 Pro上のOpenClaw:ブラウザ利用、コンピュータ利用、Codexで壁にぶつかる
ユーザーが報告:エージェントがターミナルループに陥る、サイトでブロックされる、Codexの出力が壊れる。自動化ブラウザ、macOS GUI制御、割り込みループの設定調整を模索中。

高コンテキスト長におけるローカルコーディングエージェントのKVキャッシュ量子化問題
Redditの分析によると、Qwen3-CoderやGLM 4.7などのローカルコーディングエージェントが3万トークン以上のコンテキスト長で無限修正ループや不正なJSON出力を生成する原因は、過度なKVキャッシュ量子化にあると特定され、混合精度やコンテキスト削減が回避策として推奨されています。

OpenClawコミュニティからの役立つヒント:AIエージェント最適化の深掘り
OpenClawコミュニティから、AIコーディングエージェントのパフォーマンスと効率を最適化するための貴重なヒントをご紹介します。これらの洞察は、あなたのAIプロジェクトに革命をもたらす可能性があります。