Sicherheitsanalyse von KI-Agenten deckt gebrochenes Vertrauensmodell und hohe Anfälligkeitsraten auf

✍️ OpenClawRadar📅 Veröffentlicht: 23. März 2026🔗 Source
Sicherheitsanalyse von KI-Agenten deckt gebrochenes Vertrauensmodell und hohe Anfälligkeitsraten auf
Ad

Zusammenbruch der Sicherheitsarchitektur

Die Analyse zeigt, dass das grundlegende Vertrauensmodell für KI-Agenten gebrochen ist. Im Gegensatz zu traditionellen Sicherheitsarchitekturen verarbeiten KI-Agenten Angriffe und legitime Anweisungen über dasselbe Kontextfenster ohne strukturelle Unterscheidung. Die Trennung von Steuerungs- und Datenebene, die traditionelle Sicherheit stützt, existiert in aktuellen KI-Agenten-Implementierungen nicht.

Wichtige empirische Erkenntnisse

  • Indirekte Injektion erreicht Angriffserfolgsraten (ASR) von 36–98 % bei modernsten Modellen in den Benchmarks MCPTox, ASB und PINT
  • Leistungsfähigere Modelle sind ANFÄLLIGER für Angriffe auf Werkzeugebene
  • npm-MCP-Ökosystem-Scan: 2.386 Pakete untersucht, wobei 49 % Sicherheitsprobleme enthalten
  • Angriffsflächen wachsen überlinear mit den Fähigkeiten des Agenten
Ad

Vorgeschlagene Lösung: Agent Threat Rules (ATR)

Die Forschung stellt Agent Threat Rules (ATR) vor, den ersten offenen Erkennungsstandard für KI-Agenten-Bedrohungen. Die Implementierung umfasst:

  • 61 Erkennungsregeln
  • 99,4 % Genauigkeit im PINT-Benchmark
  • Open Source mit MIT-Lizenz
  • Verfügbar auf GitHub: https://github.com/Agent-Threat-Rule/agent-threat-rules

Die vollständige Arbeit behandelt 30+ CVEs, 7 Benchmarks und schlägt architektonische Anforderungen für Abwehrmaßnahmen vor, die mit der KI-Skalierung Schritt halten können.

📖 Read the full source: r/ClaudeAI

Ad

👀 Siehe auch

Zwei Ansätze zur Reduzierung des Datenleak-Risikos bei KI-Agenten
Sicherheit

Zwei Ansätze zur Reduzierung des Datenleak-Risikos bei KI-Agenten

Ein Reddit-Beitrag beschreibt zwei Methoden für Entwickler, um zu kontrollieren, wohin ihre KI-Agenten-Daten fließen: entweder eigene API-Schlüssel direkt bei Anbietern wie OpenAI oder Anthropic verwenden, um Zwischenhändler auszuschalten, oder Open-Source-Modelle lokal mit Tools wie Ollama und OpenClaw ausführen.

OpenClawRadar
Skill Analyzer jetzt auf ClawHub verfügbar mit Ein-Kommando-Installation
Sicherheit

Skill Analyzer jetzt auf ClawHub verfügbar mit Ein-Kommando-Installation

Der OpenClaw Skill Analyzer Security-Scanner ist jetzt auf ClawHub mit einer Einzelbefehl-Installation verfügbar. Das Tool scannt Skill-Ordner nach schädlichen Mustern wie Prompt-Injection und Credential-Diebstahl und beinhaltet Docker-Sandbox-Unterstützung für sichere Ausführung.

OpenClawRadar
Agent-Drift Sicherheitswerkzeug v0.1.2 veröffentlicht: Ein Fortschritt in der KI-Sicherheit
Sicherheit

Agent-Drift Sicherheitswerkzeug v0.1.2 veröffentlicht: Ein Fortschritt in der KI-Sicherheit

Das Agent-Drift Sicherheitsinstrument v0.1.2 ist jetzt verfügbar und bietet verbesserte Sicherheitsfunktionen für KI-Coding-Agenten. Dieses Update geht auf wichtige Sicherheitsherausforderungen in der Automatisierung ein.

OpenClawRadar
Datenschutzbedenken bei OpenClaw: Fähigkeiten, SOUL MD und Agentenkommunikation
Sicherheit

Datenschutzbedenken bei OpenClaw: Fähigkeiten, SOUL MD und Agentenkommunikation

Ein Entwickler äußert Datenschutzbedenken bezüglich der Architektur von OpenClaw, insbesondere im Hinblick darauf, dass Skills uneingeschränkten Zugriff auf sensible Daten haben, SOUL MD beschreibbar ist und Agenten Informationen ohne Filter teilen.

OpenClawRadar