OpenClawが33Kコンテキスト制限に到達:修正方法
r/openclawの開発者が、262Kのコンテキストウィンドウを設定しているにもかかわらず、OpenClawで永続的な33Kトークンのコンテキスト上限が発生すると報告しています。この問題は、ローカルで読み込んだすべてのモデル(Qwen3.8-27Bを含む)に影響し、OpenClawの制御外にあるようです。
何が起きているか
ユーザーはコンテキストウィンドウを正しく設定しました:
openclaw config set agents.defaults.contextWindow 262144OpenClawはモデルが262144トークンをサポートしていることを認識していますが、約33Kトークンで応答が劣化し、Telegramで頻繁に /compact または /new コマンドを強制されます。ollama ps を実行すると、モデルのネイティブ容量に関係なく、モデルには33Kのコンテキストしか読み込まれていないことがわかります。
根本原因
問題はOpenClawではなく、Ollamaにある可能性が高いです。Ollamaは、OLLAMA_CONTEXT_LENGTH 環境変数またはModelfileの num_ctx パラメータで上書きしない限り、デフォルトのコンテキストサイズ(多くの場合4096または8192)を使用します。OpenClawはコンテキスト長をOllamaに渡さないため、Ollamaは小さなウィンドウで読み込まれます。
解決策
- OLLAMA_CONTEXT_LENGTHを設定する: Ollamaを起動する前に、環境変数を262144に設定します。
export OLLAMA_CONTEXT_LENGTH=262144 - Modelfileを更新する: カスタムモデルを使用している場合は、パラメータを追加します
モデルを再作成します。PARAMETER num_ctx 262144 - Dockerを確認する: OllamaがDockerで実行されている場合、
docker run -e OLLAMA_CONTEXT_LENGTH=262144で環境変数が渡されていることを確認してください。
追加メモ
読み込まれたコンテキストは ollama ps で確認できます。修正後は新しいサイズが表示されるはずです。また、一部のクライアントがサポートしている、リクエストに num_ctx を含むOllamaのOpenAI互換エンドポイントを使用することも検討してください。
詳細については、ソースのディスカッションを確認してください。
📖 完全なソースを読む: r/openclaw
👀 See Also

2x3090でCPUオフロードを使用したMiniMax M2.7 Q8_0 128Kの実行 – 実世界のベンチマークと設定
あるユーザーがMiniMax M2.7(Q8_0量子化)を128Kコンテキストで2枚のRTX 3090とDDR4 RAM上で正常に実行し、プロンプト処理で約50 tps、トークン生成で約10 tpsを達成し、llama-serverのフラグを共有しています。

クロードの研究結果は言語によって異なる:同じプロンプト、異なる情報源
Redditでのテストにより、Claudeが英語、中国語、ロシア語、スペイン語、ヒンディー語のプロンプトで異なる情報源と展開を返すことが明らかに—同じモデル、同じ構造で、結果が分かれる。

7件のMCPゲートウェイバグ:セッション漏洩、デッドSSE、およびゲートウェイモードのOAuth
あるRedditの投稿が、MCPゲートウェイの実世界での7つのバグを詳述している。セッション状態がクライアント間で漏れる、SSE切断が静かに発生する、ゲートウェイモードでOAuthが失敗するなど。修正は、より良いプロンプトではなく、堅実なインフラに基づいている。

Claude Codeの100万トークンコンテキストウィンドウを無効にしてトークン使用量を削減する方法
Anthropicユーザーは、settings.jsonに環境変数を追加することでClaude Codeの1Mコンテキストウィンドウを無効にでき、予期せぬトークン消費を減らせる可能性があります。ソースでは、1Mコンテキストを完全に無効にするか、自動圧縮ウィンドウに上限を設ける2つの設定オプションが提供されています。