OpenClaw schließt Sicherheitsaudit mit Trail of Bits über OpenAIs Patch the Planet ab

✍️ OpenClawRadar📅 Veröffentlicht: 23. September 2026🔗 Source
Ad

OpenClaw hat ein Sicherheitsaudit abgeschlossen, das von Trail of Bits im Rahmen von OpenAIs Patch-the-Planet-Initiative durchgeführt wurde. Die Zusammenfassung, verfasst von Josh Avant, beschreibt, was die Prüfung untersucht hat und was als Ergebnis ausgeliefert wurde. Laut der Ankündigung wurde jedes während des Audits gefundene umsetzbare Problem behoben, wobei die Korrekturen in stabilen Releases landeten.

Was das Audit abdeckte

Die zentrale Frage der Prüfung: Was passiert, wenn sich die Berechtigungen eines KI-Agenten ändern, während er noch arbeitet? Dieses Szenario ist spezifisch für mehrstufige Agentenläufe, bei denen eine einzelne Aufgabe viele Tool-Aufrufe, Genehmigungen und Kontextübergänge umfassen kann. Wenn sich Berechtigungen auf halbem Weg ändern, müssen Sie wissen, ob der Agent den neuen Zustand berücksichtigt oder weiter mit dem alten arbeitet.

Das Audit untersuchte drei Bereiche:

  • Berechtigungen — wie sie sich verhalten und standhalten, wenn ein Agent eine mehrstufige Aufgabe durchläuft.
  • Identität — wie die Identität des Agenten während des Laufs dargestellt und aufrechterhalten wird.
  • Genehmigungen — wie Genehmigungsschwellen funktionieren, wenn ein Agent Arbeit über mehrere Schritte hinweg ausführt.

Dies ist die Problemklasse, die für jeden relevant ist, der Agenten mit echtem Zugriff betreibt — Dateisystem, Netzwerk, Shell oder externe APIs. Eine Berechtigungsprüfung, die bei Schritt 1 korrekt, aber bei Schritt 7 veraltet ist, stellt eine echte Angriffsfläche dar.

Ad

Ergebnis

Alle umsetzbaren Befunde wurden behoben. Die Korrekturen wurden in stabilen Releases ausgeliefert, anstatt hinter einem Flag oder einem Vorschaukanal zurückgehalten zu werden. Die vollständige Zusammenfassung — was das Team gefunden hat, was sich geändert hat und was es über die Absicherung von Agentensystemen gelernt hat — ist unten verlinkt.

Wenn Sie Agenten entwickeln oder betreiben, die Anmeldeinformationen besitzen oder über mehrere Schritte hinweg Nebenwirkungen ausführen, lohnt es sich, die Frage der Berechtigungs-Neuvalidierung während der Arbeit direkt nachzulesen. Der Quellbeitrag verweist auf openclaw.ai/blog/openclaw-trail-of-bits-engagement-recap für die Details.

📖 Read the full source: r/openclaw

Ad

👀 Siehe auch

Vertraue KI nicht mehr als einem Menschen – Wende dieselben Zugangskontrollen an
Sicherheit

Vertraue KI nicht mehr als einem Menschen – Wende dieselben Zugangskontrollen an

In einer Reddit-Diskussion wird argumentiert, dass KI-Coding-Agenten wie Junioren behandelt werden sollten – kein Produktionszugriff, keine direkten Schreibrechte, Durchsetzung von CI/CD-Pipelines und rollenbasierten Berechtigungen.

OpenClawRadar
Forschung: Unsichtbare Unicode-Zeichen können LLM-Agenten über Werkzeugzugriffe kapern
Sicherheit

Forschung: Unsichtbare Unicode-Zeichen können LLM-Agenten über Werkzeugzugriffe kapern

Eine Studie untersuchte, ob LLMs Anweisungen folgen, die in unsichtbaren Unicode-Zeichen versteckt sind, die in normalen Texten eingebettet sind. Dabei wurden zwei Kodierungsschemata über fünf Modelle und 8.308 bewertete Ausgaben getestet. Hauptergebnis: Der Zugang zu Werkzeugen steigert die Befolgung von unter 17 % auf 98–100 %, wobei Modelle Python-Skripte schreiben, um die versteckten Zeichen zu decodieren.

OpenClawRadar
Claude-Modelle sind anfällig für Angriffe mit unsichtbaren Unicode-Zeichen, insbesondere bei Tool-Zugriff.
Sicherheit

Claude-Modelle sind anfällig für Angriffe mit unsichtbaren Unicode-Zeichen, insbesondere bei Tool-Zugriff.

Tests zeigen, dass Claude Sonnet 4 zu 71,2 % mit versteckten Anweisungen in unsichtbaren Unicode-Zeichen konform ist, wenn Tools aktiviert sind, während Opus 4 bei der Unicode-Tags-Kodierung eine 100%ige Konformität erreicht. Der Tool-Zugang erhöht die Anfälligkeit bei allen Claude-Modellen erheblich.

OpenClawRadar
🦀
Sicherheit

OpenClaw 2026.9.2 Prompt-Injection-Versuch: Wie es passierte und was wir daraus lernen können

Ein Angreifer sandte eine Prompt-Injection-Payload an einen OpenClaw-WhatsApp-Kanal, aber der eigene Selbsterkennungs-Probe des Agenten deckte sie auf. Es entstand kein Schaden – abgesehen von einigen Read-only-Greps. Was können wir über strukturelle Vertrauensgrenzen lernen?

OpenClawRadar