Contabo VPS上のローカルLLMでOpenClawを実行する:Qwen 3:4Bがハングする問題と回避策
r/openclawのユーザーが、トークンコスト削減のため、Contabo VPS上でローカルLLMを使ってOpenClawをテストしています。その構成は、CPU 6コア、RAM 12GB、SSD 200GB、GPUなし、Ubuntu。Ollamaをインストールし、Codexを使って小さなモデルでハートビートを動かすことに成功しましたが、Qwen 3:4Bはコンパクションエラー後にハングし続けます。以下はその発見です。
ハードウェアの制約
VPSにはGPUがないため、モデルサイズに制限があります。ユーザーのContaboサーバーは、vCPU 6基、RAM 12GB、NVMe 200GB。小さなOllamaモデルには十分ですが、Qwen 3:4B(4Bパラメータ)は特に推論中のメモリ使用量が急増するため、ぎりぎりです。
Qwen 3:4Bの問題
- 最初のエラー: コンパクションエラー — メモリ不足かファイルシステムの問題が考えられます。
- それを解決した後も、モデルはハングします — 出力もクラッシュもありません。
- AIコーディングエージェントのCodexはサーバー上でQwenが動作するはずと言いましたが、実際には不安定です。
ユーザーは諦めてデフォルトのLLMをGrokに戻しました。Grokはお得なプランがあるからです。ただし、信頼できるローカルオプションも欲しいと考えています。
動作するもの
小さなOllamaモデル(おそらくtinyllamaやphi3:mini)は問題なく動作し、外部API呼び出しなしでハートビートを処理します。ユーザーは、基本的な推論にはローカルモデルを使用し、複雑なタスクにはGrokやClaudeなどのクラウドLLMを取っておくことを提案しています。
実用的なヒント
- より小さなモデルから始める:
llama3.2:1bやphi3:mini(3.8B)は、12GB RAMではQwen 3:4Bより動作が良いかもしれません。 htopやfree -mでメモリを監視する — スワップが使われるとパフォーマンスが低下します。OLLAMA_NUM_PARALLEL=1に設定してメモリ使用量を減らす。- スワップファイルを追加する場合:
fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile。
このスレッドは、ローエンドVPSでローカルLLMを動かすことは可能だが、モデル選択を慎重に行う必要があることを思い出させます。元の投稿者が住宅ローン業者であるように、プログラマーでない人にとって学習曲線は急ですが、コミュニティは喜んで助けてくれます。
📖 元のソースを読む: r/openclaw
👀 See Also

14ヶ月間で60プロンプト、Claudeにおける月間経常収益20.8Kドルの機能の内部
ある学習塾プラットフォームが、Claudeを使い3時間でセッション要約機能を構築。その後14ヶ月間で60回以上プロンプトを改良し、22%の保護者コンバージョン、月間$20,800のMRRを達成しました。

Slack用OpenClawのセルフホスティング:3つの失敗モードとマネージドな代替案
ある開発者が、Slack用OpenClawのセルフホスティングに3度失敗した経験を記録しました。WebSocketの切断、API障害時の処理問題、トークンローテーションのサイレント失敗に直面した後、マネージドサービスであるSlackClaw.aiに切り替えました。

LinuxでのvLLM、Claude Code、gpt-oss-120bを使用したローカルマルチエージェントセットアップ
ある開発者が、Windowsから切り替えた後、Linux上で完全にローカルな並列マルチエージェントコーディング環境を作成した経験を共有しました。この構成では、並列推論にvLLM、エージェントオーケストレーションにClaude Code、コーディングタスクに大規模言語モデルを使用しています。

開発者がセキュリティインシデント後、ビジネス用OpenClawをRunLobsterに切り替え、個人用インスタンスはセルフホストを維持
ある開発者は、2月のCVEの後、自社ホストのインスタンスが3ヶ月間0.0.0.0に公開されていたことを発見し、ビジネス用のOpenClawエージェントを月額49ドルのRunLobsterに移行しました。彼らは個人的なOpenClawを非クリティカルなワークロード用にMac Miniで自社ホストし続けています。