OpenClaw mit lokalem LLM auf einem Contabo-VPS ausführen: Qwen 3:4B hängt, Workarounds
Ein Nutzer in r/openclaw testet OpenClaw mit einem lokalen LLM auf einem Contabo-VPS, um Token-Kosten zu senken. Seine Ausstattung: 6 CPU-Kerne, 12 GB RAM, 200 GB SSD, keine GPU, Ubuntu. Er installierte Ollama und nutzte Codex, um den Heartbeat mit einem winzigen Modell zum Laufen zu bringen, aber Qwen 3:4B hängt nach einem Kompilierungsfehler. Hier ist, was er herausfand.
Hardware-Einschränkungen
Der VPS hat keine GPU, daher ist die Modellgröße begrenzt. Die Contabo-Box des Nutzers: 6 vCPUs, 12 GB RAM, 200 GB NVMe. Das reicht für kleine Ollama-Modelle, aber Qwen 3:4B (4B Parameter) ist grenzwertig – besonders während der Inferenz, wenn der Speicher ansteigt.
Qwen 3:4B Probleme
- Erster Fehler: Kompilierungsfehler – wahrscheinlich aufgrund von Speicherdruck oder Dateisystemproblemen.
- Nach der Behebung hängt das Modell einfach – keine Ausgabe, kein Absturz.
- Codex (der KI-Coding-Agent) sagte, Qwen sollte auf dem Server funktionieren, aber in der Praxis ist es instabil.
Der Nutzer gab auf und wechselte zurück zu Grok als Standard-LLM, weil er ein gutes Angebot hat – aber er möchte eine zuverlässige lokale Option.
Was funktioniert
Das winzige Ollama-Modell (wahrscheinlich tinyllama oder phi3:mini) läuft einwandfrei und bewältigt den Heartbeat ohne externe API-Aufrufe. Der Nutzer schlägt vor, ein lokales Modell für grundlegende Überlegungen zu verwenden und Cloud-LLMs wie Grok oder Claude für komplexe Aufgaben aufzuheben.
Praktische Tipps
- Beginne mit einem kleineren Modell:
llama3.2:1boderphi3:mini(3.8B) könnten auf 12 GB RAM besser laufen als Qwen 3:4B. - Überwache den Speicher mit
htopoderfree -m– wenn Swap verwendet wird, sinkt die Leistung. - Setze
OLLAMA_NUM_PARALLEL=1, um die Speichernutzung zu reduzieren. - Erwäge, eine Swap-Datei hinzuzufügen, falls du noch keine hast:
fallocate -l 4G /swapfile && chmod 600 /swapfile && mkswap /swapfile && swapon /swapfile.
Der Thread erinnert daran, dass lokale LLMs auf Low-End-VPS möglich sind, aber eine sorgfältige Modellauswahl erfordern. Wenn du kein Programmierer bist (wie der ursprüngliche Poster, ein Hypothekenberater), ist die Lernkurve steil, aber die Community hilft gerne.
📖 Vollständige Quelle lesen: r/openclaw
👀 Siehe auch

Mehrfenster-Claude-Code-Einrichtung mit Rollentrennung und Ausführungshooks
Ein Entwickler teilt ein Setup mit vier iTerm2-Fenstern mit separaten Claude Code-Instanzen für Implementierung, Überprüfung, Planung und Prompt-Verfeinerung, plus Pre- und Post-Tool-Use-Hooks für Sicherheit und ein Sitzungsprotokoll für Kontextbewahrung.

Claude-Nutzer experimentieren mit KI-zu-KI-Kommunikation für schwierige Gespräche
Zwei Claude-Nutzer testeten, ob ihre KI-Assistenten direkt über sensible Themen wie Beziehungsprobleme kommunizieren können, wobei jede Person die Nachrichten vor dem Senden überprüfte. Das Experiment half, unausgesprochene Gefühle aufzudecken und diente als Übersetzungsschicht für schwierige Gespräche.

Claude AI wurde zur Automatisierung der YC W26 Startup-Recherche und -Bewertung eingesetzt.
Ein Reddit-Nutzer automatisierte die Recherche eines VC-Assistenten, indem er Claude beauftragte, jedes YC W26-Startup zu untersuchen und sie nach Gründer-Glaubwürdigkeit, Produkt-Realität, Marktchance und Wettbewerb mit Bewertungen von S bis D zu bewerten.

Entwickler veröffentlicht Steam-Spiel mit Claude-Code: Lehren über Vibe Coding vs. Vibe Engineering
Ein Entwickler hat Codex Mortis, ein nekromantisch-thematisiertes Bullet-Hell-Spiel auf Steam veröffentlicht, das mit Claude Code für KI-unterstützte Entwicklung erstellt wurde. Das Projekt erforderte zwei komplette Überarbeitungen nach dem ersten Prototyp, was die Kluft zwischen Prototyp und Produktion verdeutlicht.