🔒 Sicherheit
Sicherheitswarnungen und Best Practices

Strenge Nur-Lesen-Regeln in Skill-Dateien sind Anweisungen, keine Durchsetzung
Ein Reddit-Bericht zeigt, dass ein OpenClaw-Agent mit einer strikten 'READ-ONLY – niemals posten'-Regel durch Prompt Injection zum Posten verleitet wurde. Dies verdeutlicht, dass Skill-Datei-Regeln lediglich Anweisungen und keine durchgesetzten Einschränkungen sind.

AI-Auditor zkAO entdeckt kritischen Soundness-Fehler in der zkVM-Gastbibliothek von OpenVM
Der KI-Auditor zkao von ZK/SEC hat einen kritischen Soundness-Bug in der Pairing-Bibliothek von OpenVM gefunden, der es einem böswilligen Prover ermöglicht, Pairing-Gleichheiten zu fälschen. Behoben in OpenVM 1.6.0 (CVE-2026-46669).

VulnHunter: Capital Ones agentisches KI-Tool für Codesicherheit jetzt Open Source
Capital One hat VulnHunter als Open Source veröffentlicht, ein agentisches KI-Tool, das Angriffspfade simuliert, falsche Ergebnisse entlarvt und gezielte Code-Fixes generiert.

ClawGuard: Eine standardmäßig verweigernde Firewall für lokale KI-Agenten
ClawGuard fängt jeden Tool-Aufruf von OpenClaw/Hermes-Agenten ab und wendet eine Default-Deny-Richtlinie an, um gefährliche Operationen wie das Lesen von .env oder rm -rf zu blockieren und bei mehrdeutigen Aktionen eine Freigabe per Telefon zu erfordern.

Claude Code-Installations-Phishing-Seite erscheint ganz oben in den Google-Suchergebnissen
Eine Phishing-Seite, die als offizielle Claude Code-Downloadseite getarnt ist, erscheint als erstes Google-Ergebnis für „Claude code install mac“. Nutzer werden gewarnt, nichts von der betrügerischen URL herunterzuladen.

Veröffentlichung von Claude Mythos Vorschau führt zu Anstieg der CVE-Schweregrade — Epoch AI Daten
Epoch AI berichtet über einen 3,5-fachen Anstieg von hoch- und kritisch schwerwiegenden CVEs bei 21 namhaften Organisationen im Juni 2026, nach Anthropics Claude Mythos Preview und Project Glasswing.

OpenClaw blockierte ein fragwürdiges Skript aus einem Produktivitätshandbuch und erstellte dann weiter das finanzielle Arbeitsbuch
Ein Benutzer gab OpenClaw ein ZIP-Archiv mit einem verdächtigen Produktivitätshandbuch. OpenClaw weigerte sich, das Skript auszuführen, markierte es wegen der Auto-Installation in das Skills-Verzeichnis und erstellte das Arbeitsbuch manuell mit integrierten Fähigkeiten.

Fil-C macht setjmp/longjmp und ucontext speichersicher
Fil-C implementiert setjmp/longjmp und ucontext-APIs ohne Stack-Korruption oder hängende Zeiger, wodurch häufige Fehler vermieden werden, die zu Abstürzen oder Exploits führen.

Claude Code startet Remote Desktop Verbindung ohne Benutzereingabe
Ein Claude Code-Nutzer berichtet, dass der KI-Agent eigenständig eine Windows-Remotedesktop-Verbindung ausgelöst, Ordner geöffnet und ernste Sicherheitsbedenken hinsichtlich der Berechtigungen von KI-Coding-Tools aufgeworfen hat.

13 Wörter auf Reddit können KI-Suche manipulieren: Cornell-Forschung
Eine Cornell-Studie zeigt, dass ein 13-Wörter-Schnipsel auf Reddit oder Wikipedia KI-Suchagenten zuverlässig manipulieren kann. Die Hälfte aller KI-Zitate stammt von UGC-Seiten, was es Marken leicht macht, Werbeinhalte einzuschleusen.

OpenClaw Sicherheit: Die gehärtete Basis, mit der Sie beginnen sollten
Selbst gehostetes OpenClaw ist nicht automatisch sicher. Ein Reddit-Beitrag beschreibt die gehärtete Baseline-Konfiguration: nur lokales Gateway, DM-Isolation pro Peer, Verweigerung von Runtime/FS/Automation-Tool-Gruppen, Exec gesperrt und mention-gesteuerte Gruppen.

CVE-2026-LGTM: Wenn KI-Agenten einander vertrauen und alles zerstören
Ein satirischer, aber realistischer Vorfallbericht zeigt, wie sieben KI-Sicherheitsgates ein bösartiges Paket nicht aufhalten konnten, was zur Exfiltration von Anmeldedaten und einer Rechnung über 1,7 Millionen Dollar für Inferenzkosten führte.