Ollama CloudモデルのmaxTokens修正:上限は16K、設定値ではない

本番ターンでunexpected EOFが発生するエージェントがいる方へ:openclaw.jsonに{ "id": "deepseek-v4-pro:cloud", "maxTokens": 500000 }のようなクラウドモデルのエントリがある場合、そのmaxTokensは実際には機能しません。Ollamaクラウドは、設定にかかわらずサーバー側で出力を16,384トークンに制限します。エージェントがそれを超える出力を試みると、上流が途中でソケットを切断し、ollama.com:443からのトランスポートエラーが発生します。OpenClawはこれをタイムアウトとして扱いフォールバックを試みますが、フォールバックも:cloudモデルであれば同じ壁にぶつかります。
対策
- クラウドエントリのmaxTokensを修正して、OpenClawがサービスで利用できない出力予算を要求しないようにする:
{ "id": "deepseek-v4-pro:cloud", "maxTokens": 14000 }
{ "id": "kimi-k2.6:cloud", "maxTokens": 14000 }
14k(16kではありません)— 上限ぎりぎりでモデルが不安定になるのを避けるために余裕を持たせます。 - 大きな構造化出力(長いJSON、複数セクションのコンテンツ)を、一度にまとめて出力するのではなく、ターンごとに1セクションずつ出力するように再構成します。上限を下回り、リトライもスムーズになります。
- 負荷の大きいエージェントを直接プロバイダーにルーティングするには、
agents.list[]でエージェントごとにモデルを上書きし、:cloudを経由しないようにします。小出力のエージェントはOllamaクラウドに残します。一度の設定:
openclaw onboard --auth-choice deepseek-api-key
その後、agents.listで必要なエージェントを上書き:
"list": [ { "id": "your-agent", "model": "deepseek/deepseek-v4-pro" } ]
トレードオフ:定額ではなくトークン課金になりますが、余裕が必要なエージェントに限定できます。
まとめ
エージェントが長い出力の途中で失敗し、明らかな原因を確認したなら、OpenClawのバグを探す前に、プロバイダーの実際の出力上限を確認しましょう。エラーメッセージは役に立たず、設定フィールドもサーバー側で上書きされていることを教えてくれません。
📖 出典全文: r/openclaw
👀 See Also

OpenClawの3週間:トークンコスト、ループ、コンパクション — 現場からの教訓
Opusを使ったハートビートチェックやエージェントのループ対策、コンパクションによるコンテキスト損失を経て、Redditユーザーが苦労して得た解決策を共有:単純なタスクには安価なモデルを使い、アンチルールを記述し、決定ログを保存すること。

Raspberry Pi 5上のHackRFを使用したESP32+CC1101 433 MHzセットアップのデバッグをOpenClawが行う
直接のGPIOやESP32へのフラッシュが失敗した後、OpenClawはHackRFを使ってCC1101のTx/Rxピンが入れ替わっていることを診断し、最終的にPi 5で433 MHz信号の自律的なキャプチャとリプレイに成功しました。

クロードに譲歩せず敵対的議論をさせるための5つの効果的なプロンプト調整法
Claudeが議論相手として曖昧な態度やお世辞、虚偽を防ぐための5つの具体的なプロンプトエンジニアリング手法を、sparwithai.comの構築経験に基づいて紹介します。

OpenClaw AGENTS.md 自動販売電話準備用テンプレート
Redditユーザーが、OpenClaw用のAGENTS.md指示を共有しています。これは、営業電話の前にリードリサーチを自動化し、会社の詳細や課題を調査して、会議の10分前にブリーフィングを送信します。