McpVanguard: Open-Source-Sicherheitsproxy für MCP-basierte KI-Agenten

✍️ OpenClawRadar📅 Veröffentlicht: 18. April 2026🔗 Source
McpVanguard: Open-Source-Sicherheitsproxy für MCP-basierte KI-Agenten
Ad

McpVanguard ist ein Open-Source-Sicherheitsproxy und eine Firewall, die speziell für lokale KI-Agenten entwickelt wurde, die das Model Context Protocol (MCP) verwenden. Es befasst sich mit Sicherheitsbedenken, die entstehen, wenn LLMs Zugriff auf Tools wie Terminals oder Dateisysteme erhalten.

Wie es funktioniert

Der Proxy sitzt zwischen dem KI-Agenten und den MCP-Tools und umhüllt bestehende MCP-Server, ohne dass Setup-Änderungen erforderlich sind. Er kann lokal als leichtgewichtiger Proxy laufen oder als Cloud-Gateway bereitgestellt werden, wobei eine Railway-Vorlage für eine einfachere Bereitstellung verfügbar ist.

Sicherheitsschichten

  • Regel-/Signatur-Engine: Enthält etwa 50 YAML-Signaturen, die häufige Angriffe wie Reverse Shells, SSRF-Versuche und andere offensichtliche Bedrohungen erkennen. Diese Schicht fügt etwa 16 ms Latenz hinzu.
  • Semantische Bewertungsschicht (optional): Wenn Anfragen verdächtig erscheinen, aber nicht eindeutig bösartig sind, können sie von einem kleinen LLM (Ollama oder OpenAI) bewertet werden, das die Absicht einschätzt.
  • Verhaltensüberwachung: Blockiert anomale Muster, wie z.B. wenn ein Agent versucht, Hunderte von Dateien in kurzer Zeit zu lesen.
Ad

Audit-Fähigkeiten

Jede blockierte Anfrage wird in einem unveränderlichen Audit-Log aufgezeichnet, das kryptografisch signiert und lokal gespeichert wird, um einen überprüfbaren Nachweis darüber zu liefern, was blockiert wurde und warum.

Das Tool wurde entwickelt, um spezifische Sicherheitsbedenken bei MCP-Implementierungen zu adressieren, einschließlich Prompt-Injection, Path-Traversal und versehentlichem Löschen von Verzeichnissen durch KI-Agenten.

📖 Read the full source: r/LocalLLaMA

Ad

👀 Siehe auch

AviationWeather.gov-API enthält 'Stop Claude'-Prompt-Injection-Versuch
Sicherheit

AviationWeather.gov-API enthält 'Stop Claude'-Prompt-Injection-Versuch

Ein Nutzer berichtet, dass die AviationWeather.gov-API der US-Regierung in ihren Antworten den Text 'Stop Claude' zurückgibt, wenn sie über Claude CoWork abgerufen wird, was eine Sicherheitswarnung über Prompt-Injection-Angriffe auslöst.

OpenClawRadar
Sicherheits-Benchmark: 10 LLMs mit 211 adversarischen Angriffen getestet
Sicherheit

Sicherheits-Benchmark: 10 LLMs mit 211 adversarischen Angriffen getestet

Ein Sicherheitsforscher testete 10 LLMs mit 211 adversarischen Angriffen und stellte fest, dass die Extraktionsresistenz durchschnittlich bei 85 % liegt, während die Injektionsresistenz nur durchschnittlich 46,2 % beträgt. Jedes Modell versagte bei Delimiter-, Distraktor- und Style-Injection-Angriffen vollständig.

OpenClawRadar
Anthropics Computer-Nutzungsfunktion löst in realem Test Governance-Sperre aus
Sicherheit

Anthropics Computer-Nutzungsfunktion löst in realem Test Governance-Sperre aus

Anthropic führte Computer-Nutzungsfunktionen ein, und während der Implementierung von Governance-Kontrollen löste ein Risikoschwellenwert eine LOCKDOWN-Haltung aus, die alle mutierenden Operationen blockierte, einschließlich der eigenen Governance-Arbeit des Operators.

OpenClawRadar
LiteLLM v1.82.8 Kompromittierung nutzt .pth-Datei für persistente Ausführung
Sicherheit

LiteLLM v1.82.8 Kompromittierung nutzt .pth-Datei für persistente Ausführung

LiteLLM v1.82.8 wurde auf PyPI kompromittiert und enthält eine .pth-Datei, die bei jedem Start eines Python-Prozesses beliebigen Code ausführt, nicht nur wenn die Bibliothek importiert wird. Die Nutzlast wird auch dann ausgeführt, wenn LiteLLM als transitive Abhängigkeit installiert und nie direkt genutzt wird.

OpenClawRadar