Agent-Drift: Sicherheitsüberwachungstool für KI-Agenten

Agent-Drift: Sicherheitsüberwachungstool für KI-Agenten
Der Cybersecurity-Spezialist sysinternalssuite erstellte Agent-Drift—ein Open-Source-Tool zum Schutz von KI-Agenten vor Prompt-Injection, Verhaltensdrift und anderen Angriffen. Im Wesentlichen ein SIEM + IDS speziell für OpenClaw.
Warum Es Existiert
"Ich arbeite in der Cybersecurity und habe einen Anstieg von Prompt-Injection, Verhaltensdrift, Memory Poisoning und mehr bei KI-Agenten in freier Wildbahn bemerkt"
Was Agent-Drift Macht
GitHub: https://github.com/lukehebe/Agent-Drift
Das Tool funktioniert als Wrapper für OpenClaw:
- Sammelt Verhaltens-Baseline
- Erkennt Verhaltensdrift
- Alarmiert über Dashboard
Verhaltensüberwachung
Verfolgte Muster:
- Tool-Nutzungssequenzen und -frequenzen
- Timing-Anomalien
- Entscheidungsmuster
- Output-Charakteristiken
Angriffserkennung
| Angriff | Beschreibung |
|---|---|
| Instruktions-Override | Befehlsübernahme |
| Rollen-Hijacking | Rollenübernahme |
| Jailbreak-Versuche | Umgehung von Einschränkungen |
| Datenexfiltration | Datenleck |
| Kodierte Payloads | Verschleierte Payloads |
| Memory Poisoning | Speicherbeschädigung |
| Privilege Escalation | Rechteerweiterung |
| Indirekte Prompt-Injection | Indirekte Angriffe |
Wie Es Funktioniert
- Baseline-Lernen — erste Läufe etablieren normales Verhalten
- Verhaltensvektoren — jeder Lauf wird zu multidimensionalem Vektor
- Drift-Erkennung — neue Läufe werden mit Baseline verglichen
- Anomalie-Warnungen — signifikante Abweichungen lösen Warnungen aus
TL;DR
"Im Grunde ein All-in-One SIEM für deinen KI-Agenten, der als IDS fungiert und dich auch warnt, wenn deine KI anfängt, verrückt zu werden."
Quelle: u/sysinternalssuite auf r/moltbot
📖 Vollständige Quelle lesen: Reddit
👀 Siehe auch

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument
Ein sich selbst vertretender Kläger in Connecticut versteckte Prompt-Injection-Anweisungen in weißen, 3-Punkt-Schriftarten in Gerichtsdokumenten und wies jede KI an, ihn zu unterstützen. Das Gericht bemerkte es und verhängte Sanktionen.

pi-governance: RBAC, DLP und Audit-Logging für OpenClaw-Coding-Agenten
pi-governance ist ein Plugin, das zwischen KI-Codierungsagenten und Ihrem System sitzt, Werkzeugaufrufe klassifiziert und riskante Operationen blockiert. Es bietet Bash-Befehlssperrung, DLP-Scanning für Geheimnisse und PII, rollenbasierte Zugriffskontrolle und strukturierte Audit-Protokollierung ohne Konfiguration.

KI-Agenten-Berechtigungen: Menschen übersehen 1 von 3 Bedrohungen im 40k-Spiel
In einem Browser-Spiel mit 40.000 Durchläufen übersahen Menschen 1 von 3 bösartigen KI-Agentenbefehlen, wobei die Exfiltration von Anmeldedaten in 35 % der Fälle übersehen wurde. Der am häufigsten übersehene Befehl war `npm run analyze` mit 64,7 %.

KI-System entdeckt 12 Zero-Day-Schwachstellen in OpenSSL, Curl stoppt Bug-Bounty-Programm wegen KI-Spam
Das KI-System von AISLE entdeckte alle 12 Zero-Day-Schwachstellen im aktuellen Sicherheits-Release von OpenSSL, was die erste groß angelegte Demonstration KI-basierter Cybersicherheit darstellt. Gleichzeitig hat curl sein Bug-Bounty-Programm aufgrund von KI-generierten Spam-Einreichungen eingestellt.