OpenClaw lokal mit Jetson Nano und Gaming-Laptop unter Verwendung von Ollama ausführen

Ein Entwickler dokumentierte seine Lösung, OpenClaw lokal auszuführen, um Cloud-API-Kosten und Zuverlässigkeitsprobleme zu vermeiden. Er stieß auf Probleme mit Cloud-LLM-Diensten, einschließlich Gemini und Clawd, die die Nutzung von Pro-Plänen sperrten, Claude-Serverausfällen und sich ansammelnden OpenAI-API-Gebühren von 200 US-Dollar pro Woche.
Hardware-Einrichtung
Das System verwendet zwei Geräte:
- Jetson Nano, auf dem OpenClaw läuft
- MSI-Gaming-Laptop von 2022, auf dem Qwen 3.5 9B über Ollama läuft
Implementierungsdetails
Der Gaming-Laptop war nicht für den 24/7-Betrieb ausgelegt, daher konfigurierten sie Wake-on-LAN-Funktionalität, um ihn nur bei Bedarf einzuschalten. Sie verwendeten LM Studio, um das passende Modell auszuwählen und zu testen, bevor sie sich für Qwen 3.5 9B entschieden.
Das System implementiert Hybrid-Routing: Die meisten Aufgaben nutzen das lokale LLM, aber komplexere Aufgaben werden automatisch an die OpenAI-API weitergeleitet. Dieser Ansatz gewährleistet Funktionalität bei gleichzeitiger erheblicher Kostenreduzierung.
Ergebnisse
Das Setup läuft jetzt 24/7 und hat im Vergleich zu reinen Cloud-Lösungen erheblich Geld gespart. Der Entwickler merkte an, dass der Konfigurationsprozess zeitaufwändig war, und erstellte ein Schritt-für-Schritt-Video, das das gesamte Verfahren dokumentiert.
📖 Read the full source: r/openclaw
👀 Siehe auch

OpenClaw Agent Voice Call Demo mit Streaming TTS und Barge-in
Ein Entwickler hat seinen OpenClaw-Agenten demonstriert, der tatsächlich Telefonanrufe über Telegram tätigt. Dabei nutzt er Streaming-Text-to-Speech, der Satz für Satz antwortet und Barge-in für natürliche Gespräche unterstützt.

Verwendung von Claude Code zur Automatisierung von KI-Forschungsexperimenten für 12 Stunden
Ein Entwickler nutzte Claude Code, um 12 Stunden lang automatisierte KI-Forschungsexperimente durchzuführen und ein kontinuierliches Lernframework zu optimieren, um die Einhaltung von Präferenzprüfern durch das Modell zu maximieren. Das System führte 9 Experimente durch, behebt einen Modellkollaps-Fehler und erreichte eine Compliance von 100 % ausgehend von 0 %.

Feinabstimmung von llama3.2 3B für personalisiertes Gesundheitscoaching unter Verwendung von Apple Watch-Daten und MLX
Ein Entwickler feintunte llama3.2 3B auf einem Mac mit MLX in 15 Minuten, um einen Gesundheits-Coach-LLM zu erstellen, der persönliche Apple Health- und Whoop-Daten analysiert. Das Modell liefert spezifische Gesundheitserkenntnisse statt allgemeiner Ratschläge und läuft lokal mit einem Speicherbedarf von 2 GB.

Entwickler baut YouTube-Nachrichten-Multistream-Viewer mit Claude Code
Ein Entwickler nutzte Claude Code, um Beholder zu erstellen – ein Echtzeit-Nachrichtenüberwachungs-Dashboard, das Dutzende von Live-YouTube-Nachrichtenstreams gleichzeitig mit Angaben zur Medienvoreingenommenheit anzeigt. Das Tool umfasst über 200 Kanäle, Live-Nachrichtenticker und funktioniert auf Mobilgeräten, Tablets und Desktop-Computern.