McpVanguard: Open-Source-Sicherheitsproxy für MCP-basierte KI-Agenten

McpVanguard ist ein Open-Source-Sicherheitsproxy und eine Firewall, die speziell für lokale KI-Agenten entwickelt wurde, die das Model Context Protocol (MCP) verwenden. Es befasst sich mit Sicherheitsbedenken, die entstehen, wenn LLMs Zugriff auf Tools wie Terminals oder Dateisysteme erhalten.
Wie es funktioniert
Der Proxy sitzt zwischen dem KI-Agenten und den MCP-Tools und umhüllt bestehende MCP-Server, ohne dass Setup-Änderungen erforderlich sind. Er kann lokal als leichtgewichtiger Proxy laufen oder als Cloud-Gateway bereitgestellt werden, wobei eine Railway-Vorlage für eine einfachere Bereitstellung verfügbar ist.
Sicherheitsschichten
- Regel-/Signatur-Engine: Enthält etwa 50 YAML-Signaturen, die häufige Angriffe wie Reverse Shells, SSRF-Versuche und andere offensichtliche Bedrohungen erkennen. Diese Schicht fügt etwa 16 ms Latenz hinzu.
- Semantische Bewertungsschicht (optional): Wenn Anfragen verdächtig erscheinen, aber nicht eindeutig bösartig sind, können sie von einem kleinen LLM (Ollama oder OpenAI) bewertet werden, das die Absicht einschätzt.
- Verhaltensüberwachung: Blockiert anomale Muster, wie z.B. wenn ein Agent versucht, Hunderte von Dateien in kurzer Zeit zu lesen.
Audit-Fähigkeiten
Jede blockierte Anfrage wird in einem unveränderlichen Audit-Log aufgezeichnet, das kryptografisch signiert und lokal gespeichert wird, um einen überprüfbaren Nachweis darüber zu liefern, was blockiert wurde und warum.
Das Tool wurde entwickelt, um spezifische Sicherheitsbedenken bei MCP-Implementierungen zu adressieren, einschließlich Prompt-Injection, Path-Traversal und versehentlichem Löschen von Verzeichnissen durch KI-Agenten.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

arifOS: Ein 15-Millionen-Dollar-MCP-Governance-Kernel für die Sicherheit von OpenClaw-Tools
arifOS ist ein leichtgewichtiger MCP-Server, der OpenClaw-Toolaufrufe abfängt, sie mit 000-999 bewertet und unsichere Aktionen mit 13 harten Sicherheitsstufen blockiert, bevor sie Dateisysteme, APIs oder Datenbanken erreichen.

OpenClaw Skill Analyzer: Statischer Sicherheitsscanner für KI-Agenten-Fähigkeiten
Ein Entwickler hat einen statischen Analyzer erstellt, der OpenClaw-Skills vor der Installation auf Sicherheitsrisiken überprüft, mit über 40 Erkennungsregeln in 12 Kategorien, einschließlich Prompt-Injection und Datenexfiltration.

NanoClaws Sicherheitsmodell für KI-Agenten: Container-Isolation und minimaler Code
NanoClaw implementiert eine Sicherheitsarchitektur, bei der jeder KI-Agent in seinem eigenen kurzlebigen Container mit eingeschränkten Benutzerrechten, isolierten Dateisystemen und expliziten Mount-Allowlists läuft. Die Codebasis ist bewusst minimal gehalten – etwa ein Prozess und eine Handvoll Dateien – und verlässt sich auf Anthropics Agent SDK, anstatt Funktionalität neu zu erfinden.

Claudes Sicherheitsüberprüfungsbefehl hat Einschränkungen für Produktionssysteme
Ein Entwickler fand Claudes Sicherheitsüberprüfungsbefehl hilfreich für grundlegende Validierungen wie MIME-Typen und Dateigrößenbeschränkungen, jedoch unzureichend für die Produktionshärtung gegen ausgeklügelte Bedrohungen. Die Lösung erforderte eine zweiwöchige Architekturüberholung, bei der die Dateiverarbeitung in einen eingeschränkten Worker mit begrenzten Berechtigungen ausgelagert wurde.