OpenClaw mit lokalem LLM auf einem Contabo-VPS ausführen: Qwen 3:4B hängt, Workarounds
Ein Nutzer in r/openclaw testet OpenClaw mit einem lokalen LLM auf einem Contabo-VPS, um Token-Kosten zu senken. Seine Ausstattung: 6 CPU-Kerne, 12 GB RAM, 200 GB SSD, keine GPU, Ubuntu. Er installierte Ollama und nutzte Codex, um den Heartbeat mit einem winzigen Modell zum Laufen zu bringen, aber Qwen 3:4B hängt nach einem Kompilierungsfehler. Hier ist, was er herausfand.
Hardware-Einschränkungen
Der VPS hat keine GPU, daher ist die Modellgröße begrenzt. Die Contabo-Box des Nutzers: 6 vCPUs, 12 GB RAM, 200 GB NVMe. Das reicht für kleine Ollama-Modelle, aber Qwen 3:4B (4B Parameter) ist grenzwertig – besonders während der Inferenz, wenn der Speicher ansteigt.
Qwen 3:4B Probleme
- Erster Fehler: Kompilierungsfehler – wahrscheinlich aufgrund von Speicherdruck oder Dateisystemproblemen.
- Nach der Behebung hängt das Modell einfach – keine Ausgabe, kein Absturz.
- Codex (der KI-Coding-Agent) sagte, Qwen sollte auf dem Server funktionieren, aber in der Praxis ist es instabil.
Der Nutzer gab auf und wechselte zurück zu Grok als Standard-LLM, weil er ein gutes Angebot hat – aber er möchte eine zuverlässige lokale Option.
Was funktioniert
Das winzige Ollama-Modell (wahrscheinlich tinyllama oder phi3:mini) läuft einwandfrei und bewältigt den Heartbeat ohne externe API-Aufrufe. Der Nutzer schlägt vor, ein lokales Modell für grundlegende Überlegungen zu verwenden und Cloud-LLMs wie Grok oder Claude für komplexe Aufgaben aufzuheben.
Praktische Tipps
- Beginne mit einem kleineren Modell:
llama3.2:1boderphi3:mini(3.8B) könnten auf 12 GB RAM besser laufen als Qwen 3:4B. - Überwache den Speicher mit
htopoderfree -m– wenn Swap verwendet wird, sinkt die Leistung. - Setze
OLLAMA_NUM_PARALLEL=1, um die Speichernutzung zu reduzieren. - Erwäge, eine Swap-Datei hinzuzufügen, falls du noch keine hast:
fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.
Der Thread erinnert daran, dass lokale LLMs auf Low-End-VPS möglich sind, aber eine sorgfältige Modellauswahl erfordern. Wenn du kein Programmierer bist (wie der ursprüngliche Poster, ein Hypothekenberater), ist die Lernkurve steil, aber die Community hilft gerne.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

Praktische OpenClaw-Einrichtung: Mac Mini-Konfiguration, Kostenmanagement und tägliche Automatisierung
Ein Entwickler teilt sein grundlegendes OpenClaw-Assistenten-Setup, das auf einem Mac Mini läuft, und erläutert Sicherheitsmaßnahmen, Kostenoptimierung von anfänglichen 60-70 US-Dollar API-Gebühren auf 0,60-2,60 US-Dollar täglich sowie praktische Integrationen wie Telegram, Dropbox und Google Workspace über Composio.

Linke Argumente für KI: Behinderung, chronische Krankheit und Klasse
Sean Goedecke argumentiert, dass LLMs linke Werte unterstützen, indem sie behinderten Menschen helfen, Patienten mit chronischen Krankheiten bei der Bewältigung medizinischer Hürden unterstützen und Klassen-Code-Switching zur bürokratischen Sprache ermöglichen.

OpenClaw-Benutzer kämpfen mit der KI-Agenten-Automatisierung nach erfolgreicher Claude-Code-Pipeline
Ein Inhaber einer Marketingagentur hat erfolgreich eine Pipeline zur Bildrekonstruktion mit Claude Code in einer Stunde erstellt, stieß jedoch auf Probleme, als er versuchte, denselben Prozess einem KI-Agenten in OpenClaw, der auf Gemini 3.1 Pro läuft, beizubringen. Die Probleme umfassten schlechte Argumentationsfähigkeiten, langsame Antwortzeiten und fehlerhafte Ausgaben.

Benutzer-Workflow: Planung mit Claude.ai und Implementierung mit Claude Code
Ein Entwickler beschreibt die Nutzung von Claude.ai für detaillierte Planungs- und Architekturdiskussionen, dann Claude Code für die Implementierung, merkt aber an, dass es keinen gemeinsamen Status zwischen den beiden Tools gibt, was manuelle Dateiübertragungen erfordert.