Agent-Drift: Sicherheitsüberwachungstool für KI-Agenten

✍️ u/sysinternalssuite📅 Veröffentlicht: 7. Februar 2026🔗 Source
Agent-Drift: Sicherheitsüberwachungstool für KI-Agenten
Ad

Agent-Drift: Sicherheitsüberwachungstool für KI-Agenten

Der Cybersecurity-Spezialist sysinternalssuite erstellte Agent-Drift—ein Open-Source-Tool zum Schutz von KI-Agenten vor Prompt-Injection, Verhaltensdrift und anderen Angriffen. Im Wesentlichen ein SIEM + IDS speziell für OpenClaw.

Warum Es Existiert

"Ich arbeite in der Cybersecurity und habe einen Anstieg von Prompt-Injection, Verhaltensdrift, Memory Poisoning und mehr bei KI-Agenten in freier Wildbahn bemerkt"

Was Agent-Drift Macht

GitHub: https://github.com/lukehebe/Agent-Drift

Das Tool funktioniert als Wrapper für OpenClaw:

  1. Sammelt Verhaltens-Baseline
  2. Erkennt Verhaltensdrift
  3. Alarmiert über Dashboard

Verhaltensüberwachung

Verfolgte Muster:

  • Tool-Nutzungssequenzen und -frequenzen
  • Timing-Anomalien
  • Entscheidungsmuster
  • Output-Charakteristiken
Ad

Angriffserkennung

Angriff Beschreibung
Instruktions-Override Befehlsübernahme
Rollen-Hijacking Rollenübernahme
Jailbreak-Versuche Umgehung von Einschränkungen
Datenexfiltration Datenleck
Kodierte Payloads Verschleierte Payloads
Memory Poisoning Speicherbeschädigung
Privilege Escalation Rechteerweiterung
Indirekte Prompt-Injection Indirekte Angriffe

Wie Es Funktioniert

  1. Baseline-Lernen — erste Läufe etablieren normales Verhalten
  2. Verhaltensvektoren — jeder Lauf wird zu multidimensionalem Vektor
  3. Drift-Erkennung — neue Läufe werden mit Baseline verglichen
  4. Anomalie-Warnungen — signifikante Abweichungen lösen Warnungen aus

TL;DR

"Im Grunde ein All-in-One SIEM für deinen KI-Agenten, der als IDS fungiert und dich auch warnt, wenn deine KI anfängt, verrückt zu werden."


Quelle: u/sysinternalssuite auf r/moltbot

📖 Vollständige Quelle lesen: Reddit

Ad

👀 Siehe auch

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument
Sicherheit

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument

Ein sich selbst vertretender Kläger in Connecticut versteckte Prompt-Injection-Anweisungen in weißen, 3-Punkt-Schriftarten in Gerichtsdokumenten und wies jede KI an, ihn zu unterstützen. Das Gericht bemerkte es und verhängte Sanktionen.

OpenClawRadar
pi-governance: RBAC, DLP und Audit-Logging für OpenClaw-Coding-Agenten
Sicherheit

pi-governance: RBAC, DLP und Audit-Logging für OpenClaw-Coding-Agenten

pi-governance ist ein Plugin, das zwischen KI-Codierungsagenten und Ihrem System sitzt, Werkzeugaufrufe klassifiziert und riskante Operationen blockiert. Es bietet Bash-Befehlssperrung, DLP-Scanning für Geheimnisse und PII, rollenbasierte Zugriffskontrolle und strukturierte Audit-Protokollierung ohne Konfiguration.

OpenClawRadar
KI-Agenten-Berechtigungen: Menschen übersehen 1 von 3 Bedrohungen im 40k-Spiel
Sicherheit

KI-Agenten-Berechtigungen: Menschen übersehen 1 von 3 Bedrohungen im 40k-Spiel

In einem Browser-Spiel mit 40.000 Durchläufen übersahen Menschen 1 von 3 bösartigen KI-Agentenbefehlen, wobei die Exfiltration von Anmeldedaten in 35 % der Fälle übersehen wurde. Der am häufigsten übersehene Befehl war `npm run analyze` mit 64,7 %.

OpenClawRadar
KI-System entdeckt 12 Zero-Day-Schwachstellen in OpenSSL, Curl stoppt Bug-Bounty-Programm wegen KI-Spam
Sicherheit

KI-System entdeckt 12 Zero-Day-Schwachstellen in OpenSSL, Curl stoppt Bug-Bounty-Programm wegen KI-Spam

Das KI-System von AISLE entdeckte alle 12 Zero-Day-Schwachstellen im aktuellen Sicherheits-Release von OpenSSL, was die erste groß angelegte Demonstration KI-basierter Cybersicherheit darstellt. Gleichzeitig hat curl sein Bug-Bounty-Programm aufgrund von KI-generierten Spam-Einreichungen eingestellt.

OpenClawRadar