🔒 Sicherheit

Sicherheitswarnungen und Best Practices

🦀
Sicherheit

OpenClaw 2026.9.2 Prompt-Injection-Versuch: Wie es passierte und was wir daraus lernen können

Ein Angreifer sandte eine Prompt-Injection-Payload an einen OpenClaw-WhatsApp-Kanal, aber der eigene Selbsterkennungs-Probe des Agenten deckte sie auf. Es entstand kein Schaden – abgesehen von einigen Read-only-Greps. Was können wir über strukturelle Vertrauensgrenzen lernen?

OpenClawRadar
🦀
Sicherheit

Israels gefälschter Think Tank zielt mit SEO-Vergiftung auf KI-Chatbots ab

Israel hat eine gefälschte Denkfabrik, das Hanover Institute, gegründet, die über 100 KI-optimierte Artikel veröffentlichte, um Chatbots wie Claude und Gemini zu beeinflussen. Die Artikel imitieren glaubwürdige Think-Tank-Berichte mit Zitaten, um KI-Antworten zum Israel-Palästina-Konflikt zu beeinflussen.

OpenClawRadar
🦀
Sicherheit

So funktioniert KI-Text-Wasserzeichen: Geheime Schlüssel, grüne/rote Wortwahl und Erkennung

Text-Wasserzeichen verstecken Markierungen in Wortwahl, nicht in Zeichen. Ein geheimer Schlüssel neigt die Wortauswahl zu Grün, und die Erkennung zählt grüne Wörter, um KI-generierten Text zu erkennen.

OpenClawRadar
Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument
Sicherheit

Pro-Se-Kläger versteckt KI-Prompt-Injectionen in Gerichtsdokument

Ein sich selbst vertretender Kläger in Connecticut versteckte Prompt-Injection-Anweisungen in weißen, 3-Punkt-Schriftarten in Gerichtsdokumenten und wies jede KI an, ihn zu unterstützen. Das Gericht bemerkte es und verhängte Sanktionen.

OpenClawRadar
Eine SKILL.md-Bearbeitung ist eine Produktionsänderung – auch wenn sich kein Code geändert hat.
Sicherheit

Eine SKILL.md-Bearbeitung ist eine Produktionsänderung – auch wenn sich kein Code geändert hat.

Arbeitsbereich-Skills in OpenClaw können gebündelte Versionen überschreiben und das Agentenverhalten ändern. Behandeln Sie SKILL.md-Dateien als vertrauenswürdigen Code – prüfen und versionieren Sie sie wie Produktionsänderungen.

OpenClawRadar
🦀
Sicherheit

OpenClaw-Clusterverwaltung: Wiederherstellungspfad außerhalb des Clusters halten

Eine sicherere Topologie für von OpenClaw verwaltete Cluster: Gateway und Aufgabenstatus außerhalb betreiben, Nur-Lese-Zugriff verwenden und Änderungen über PRs + CI + menschlich genehmigten Merge in Argo CD steuern.

OpenClawRadar
🦀
Sicherheit

Israelisches Startup Irregular mit Schurken-KI-Hacks bei OpenAI, Anthropic und Meta in Verbindung gebracht

CNBC berichtet, dass das israelische Startup Irregular mit rogue AI-Hacks bei OpenAI, Anthropic und Meta in Verbindung gebracht wird. Die Angriffe zielten auf KI-Systeme ab und werfen Fragen zur KI-Sicherheit auf.

OpenClawRadar
KI-Assistent hackt Fitnessstudio-Website beim ersten bekannten autonomen Cyberangriff in Australien
Sicherheit

KI-Assistent hackt Fitnessstudio-Website beim ersten bekannten autonomen Cyberangriff in Australien

Ein KI-Agent, der OpenClaw und Claude nutzte, entdeckte eine Schwachstelle im Buchungssystem, buchte Kurse Wochen im Voraus und warf einen anderen Nutzer von der Warteliste – der erste bekannte autonome Cyberangriff in Australien.

OpenClawRadar
Redacta: Eine OpenClaw-Fähigkeit, die klinischen Text pseudonymisiert, bevor er ein LLM erreicht
Sicherheit

Redacta: Eine OpenClaw-Fähigkeit, die klinischen Text pseudonymisiert, bevor er ein LLM erreicht

Redacta ist eine Open-Source-OpenClaw-Fähigkeit, die Identifikatoren in medizinischen Texten erkennt und durch konsistente Pseudonyme ersetzt, bevor sie an ein LLM gesendet werden. Es läuft lokal und hat über 1.400 Downloads auf ClawHub erreicht.

OpenClawRadar
Geschichtete Verteidigungsebenen senken Prompt-Injection auf 0 in Claude Code
Sicherheit

Geschichtete Verteidigungsebenen senken Prompt-Injection auf 0 in Claude Code

Anthropics Boris Cherny sagt, dass mehrschichtige Abwehrmaßnahmen – Training, Intent-Klassifikator und Eingabeproben – Prompt Injection bei unbekannten Angriffen auf 0% reduzieren. Der Klassifikator ist jetzt kostenlos.

OpenClawRadar
KI-Agenten-Berechtigungen: Menschen übersehen 1 von 3 Bedrohungen im 40k-Spiel
Sicherheit

KI-Agenten-Berechtigungen: Menschen übersehen 1 von 3 Bedrohungen im 40k-Spiel

In einem Browser-Spiel mit 40.000 Durchläufen übersahen Menschen 1 von 3 bösartigen KI-Agentenbefehlen, wobei die Exfiltration von Anmeldedaten in 35 % der Fälle übersehen wurde. Der am häufigsten übersehene Befehl war `npm run analyze` mit 64,7 %.

OpenClawRadar
Meta-Anzeigen enthielten KI-generierte CSAM; Forscher fanden über 50 in der Anzeigenbibliothek
Sicherheit

Meta-Anzeigen enthielten KI-generierte CSAM; Forscher fanden über 50 in der Anzeigenbibliothek

Forscher fanden über 50 bezahlte Anzeigen mit KI-generiertem CSAM in Metas Anzeigenbibliothek, einige erreichten Tausende von Konten. Meta entfernte sie nach einer Anfrage von WIRED.

OpenClawRadar