Umgehung der NemoClaw-Sandbox-Isolierung für den lokalen Nemotron 9B-Agenten

Lokale NemoClaw-Umgehung für vollständig lokale Inferenz
Ein Entwickler hat eine Methode dokumentiert, um die Sandbox-Isolation von NVIDIAs NemoClaw zu umgehen und einen vollständig lokalen KI-Agenten auszuführen. NemoClaw, das auf der GTC vorgestellt wurde, ist eine Unternehmens-Sandbox für KI-Agenten, die auf OpenShell (k3s + Landlock + seccomp) basiert und standardmäßig Cloud-API-Verbindungen erwartet sowie lokale Netzwerkverbindungen stark einschränkt.
Technische Implementierungsdetails
Der Entwickler wollte 100% lokale Inferenz auf WSL2 + RTX 5090 erreichen und durchbrach die Sandbox, um eine vLLM-Instanz zu erreichen. Die Lösung umfasste mehrere Komponenten:
- Host-iptables-Konfiguration: Erlaubte Datenverkehr von der Docker-Bridge zu vLLM auf Port 8000
- Pod-TCP-Relay: Benutzerdefinierter Python-Relay im Haupt-Namespace des Pods, der die Sandbox-veth mit der Docker-Bridge verbindet
- Sandbox-iptables-Injektion: Verwendete
nsenter, um eine ACCEPT-Regel in die OUTPUT-Kette der Sandbox einzufügen und die Standard-REJECT-Regel zu umgehen - Tool-Aufruf-Übersetzung: Erstellte ein benutzerdefiniertes Gateway, das die Streaming-SSE-Antwort von vLLM abfängt, puffert, die
<TOOLCALL>[...]</TOOLCALL>-Textausgabe von Nemotron 9B analysiert und sie in Echtzeit in OpenAI-kompatibletool_callsumschreibt
Diese Konfiguration ermöglicht es opencode innerhalb der Sandbox, Nemotron als vollständig autonomen Agenten zu nutzen. Alles läuft lokal, ohne dass Daten das Gerät verlassen. Das Setup ist flüchtig (WSL2-Neustarts löschen die iptables-Hacks), ermöglicht aber einem 9B-Modell, Terminalbefehle innerhalb eines abgeschotteten Unternehmenscontainers auszuführen.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

OpenClaw-Benchmark zeigt: Qwen3.5:27B übertrifft andere lokale LLMs bei Agenten-Aufgaben
Ein Benchmark von 7 lokalen LLMs bei 22 realen Agentenaufgaben mit OpenClaw ergab, dass qwen3.5:27b-q4_K_M mit 59,4 % abschnitt, während der Zweitplatzierte qwen3.5:35b nur 23,2 % erreichte. Die meisten Modelle konnten grundlegende Werkzeuge wie E-Mail-Funktionen nicht finden.

Benchmark zeigt: CLI-Tool reduziert Claude-Code-Token-Kosten um 32 % durch strukturelle Navigation
Ein Entwickler hat ein Rust-CLI-Tool erstellt, das Claude-Code-Agenten strukturelle Navigationsbefehle wie 'zeige mir eine 180-Token-Zusammenfassung dieser 6.000-Token-Klasse' ermöglicht. Benchmarks mit Sonnet 4.6 über 54 automatisierte Durchläufe zeigten 32 % niedrigere Kosten pro Aufgabe und 67 % mehr Codeänderungen pro Sitzung.

Claude Code v2.1.59 fügt Auto-Memory, den Copy-Befehl und Shell-Verbesserungen hinzu.
Claude Code v2.1.59 führt automatisches Kontextspeichern in den Auto-Speicher mit /memory-Verwaltung ein, fügt einen /copy-Befehl für interaktive Codeblock-Auswahl hinzu und verbessert Präfix-Vorschläge für zusammengesetzte Bash-Befehle.

Claude Skills zur Nachbildung einer Designstudio-Umgebung
Ein Designer teilt zwei Claude-Fähigkeiten: Eine simuliert ein Studio mit Teamkollegen und Designmethoden, die andere fügt ‚rigoroses Spiel‘ für Kreativität hinzu.