Sandboxing lokaler KI-Agenten mit Firecracker MicroVMs

Sicherheitsansatz für lokale KI-Agenten
Ein Entwickler auf r/LocalLLaMA teilte seinen Ansatz zur Abschottung von KI-Agenten-Ausführungen, um Sicherheitsbedenken zu begegnen. Er merkte an, dass die meisten lokalen KI-Agenten-Setups Code direkt auf dem Host-Rechner ausführen, was einem kompromittierten Agenten ermöglichen könnte, Dateien zu löschen oder das System zu beschädigen.
Technische Umsetzung
Die Lösung beinhaltet die Isolierung der Agenten-Ausführung innerhalb einer Firecracker-Mikro-VM. Firecracker ist dieselbe Mikro-VM-Technologie, die auch hinter AWS Lambda steckt und schnelle Startzeiten von nur wenigen Sekunden bietet.
Die Umsetzung umfasst:
- Booten einer schlanken Alpine-Linux-VM
- Bereitstellung von Python, Bash und Git innerhalb der VM für den Agenten
- Nutzung von vsock für die Kommunikation (kein Netzwerk erforderlich)
- Beenden der VM bei Problemen
Der Entwickler hat dies in eine kleine Sandbox verpackt, die sich über MCP (Model Context Protocol) mit Claude Desktop verbinden kann.
Aktuelle Einschränkungen
Die aktuelle Umsetzung hat mehrere Beschränkungen:
- Unterstützt nur eine Sandbox-VM gleichzeitig
- Benötigt Linux mit KVM oder WSL2
- Erfordert sudo-Berechtigungen
- Befindet sich noch in frühen Entwicklungsstadien
Der Entwickler sucht Feedback von anderen, die mit der Abschottung von Agenten-Ausführungen für MCP oder lokale Agenten experimentieren.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Testen von unzensierten Qwen 3.5 35B-Modellen für Cybersicherheitsfragen
Ein Cybersicherheitsexperte testete drei unzensierte Qwen 3.5 35B-Modelle mit Fragen zu Hacking und Sicherheitsumgehungen und stellte erhebliche Unterschiede in der Antwortqualität im Vergleich zum ursprünglichen zensierten Modell fest. Die unzensierten Modelle lieferten konsequent Antworten, bei denen das Originalmodell entweder ablehnte oder unvollständige Antworten gab.

KI-Sicherheitsforscher: Ihre 0-Day-Schwachstellen könnten über die Dateneinwilligungs-Option durchsickern
Die Schaltfläche 'Verbessere das Modell für alle' in LLM-Schnittstellen kann tiefgehende Red-Teaming-Forschung automatisch erfassen, deine Sicherheitslückenkonzepte an Anbieter-Sicherheitsteams und möglicherweise an akademische Papiere senden, bevor du veröffentlichst. Deaktiviere die Datenteilung, bevor du ernsthafte Sicherheitsforschung betreibst.

Sunder: Eine Rust-basierte lokale Datenschutz-Firewall für LLMs
Sunder ist eine Chrome-Erweiterung, die als lokale Datenschutz-Firewall für KI-Chats fungiert und mit Rust und WebAssembly erstellt wurde, um sicherzustellen, dass keine sensiblen Daten Ihren Browser verlassen.

Google berichtet, KI-gestützte Hacking-Angriffe hätten in drei Monaten industrielles Ausmaß erreicht
Die Bedrohungsforschungsgruppe von Google hat festgestellt, dass kriminelle und staatliche Gruppen kommerzielle KI-Modelle (Gemini, Claude, OpenAI) nutzen, um Angriffe zu verfeinern und auszuweiten. Eine Gruppe war kurz davor, eine Zero-Day-Schwachstelle für Massenexploits zu nutzen, und andere experimentieren mit dem ungeschützten OpenClaw-Agenten.