Meta-Anzeigen enthielten KI-generierte CSAM; Forscher fanden über 50 in der Anzeigenbibliothek

Meta hat bezahlte Anzeigen mit KI-generiertem Kindesmissbrauchsmaterial (CSAM) und Bildern von Minderjährigen mit sexuell anzüglichem Text geschaltet, so ein Bericht des Tech Transparency Project (TTP), der WIRED vorliegt. Über 50 Bild- und Videoanzeigen wurden in Metas Anzeigenbibliothek entdeckt, einige erreichten Tausende von Konten in den USA, Großbritannien und Europa.
Wichtigste Erkenntnisse
- Anzeigen liefen von November 2024 bis August 2025 und zielten auf Männer in mehreren Ländern.
- Eine Videoanzeige verwendete ein Thumbnail eines Kindes mit dem Text: „Realizing Deep Fantasies with Generation AI. There is so much more than what is shown, use your imagination." Beim Anklicken zeigten sich Erwachsene in sexuellen Handlungen, dann wurde das Gesicht des Kindes hinzugefügt.
- Eine weitere Anzeige zeigte ein junges Mädchen mit gespreizten Beinen und dem Text „I can show you more."
- Die meisten Anzeigen hatten eine geringe Reichweite, aber eine erreichte 2.563 Konten in Europa.
- Anzeigen verlinkten zu "Nudify"- oder Entkleidungs-Apps.
- TTP meldete die Ergebnisse an die NCMEC CyberTipline; NCMEC kommentiert Berichte nicht.
Meta entfernte die Anzeigen, nachdem WIRED Kontakt aufgenommen hatte. Ein Sprecher sagte, man arbeite aggressiv daran, solche Inhalte von der Plattform fernzuhalten, und wies darauf hin, dass viele Anzeigen eine geringe Reichweite hatten und einige älter sind als die neuen KI-Erkennungstools. Meta gibt an, im letzten Jahr über 36 Millionen Stücke von CSE-Inhalten entfernt zu haben und rechtliche Schritte gegen Entwickler von Nudify-Apps einzuleiten.
Allerdings fanden Forscher Stunden vor Veröffentlichung 30 weitere Anzeigen, einige davon live, nachdem Meta bereits alarmiert worden war. Dies deutet darauf hin, dass die KI-Erkennungssysteme nicht vollständig wirksam sind.
Implikationen für Entwickler
Dieser Vorfall unterstreicht die anhaltende Herausforderung, KI-generierte Inhalte in großem Maßstab zu moderieren. Für Entwickler, die KI-Moderation von Inhalten aufbauen, ist die wichtigste Erkenntnis die Notwendigkeit einer robusten Erkennung von synthetischem CSAM, das sich von traditionellem Bildmaterial unterscheiden kann. Die Tatsache, dass diese Anzeigen den Überprüfungsprozess von Meta passierten, deutet auf Lücken in der automatisierten und menschlichen Moderation hin.
📖 Lesen Sie die vollständige Quelle: HN AI Agents
👀 Siehe auch

KI-Agenten-Schutzmaßnahmen verlieren ohne aktive Wartung mit der Zeit an Wirksamkeit.
KI-Agenten-Schutzmaßnahmen verschlechtern sich mit der Zeit, da Systemaufforderungen Aktualisierungen ansammeln, Modellversionen wechseln und neue Tools hinzugefügt werden, was oft zu widersprüchlichen oder ignorierten Sicherheitsregeln führt, die regelmäßige Überprüfung und Tests erfordern.

Roblox-Betrug und KI-Tool verursachten Ausfall der Vercel-Plattform
Ein Roblox-Cheat in Kombination mit einem KI-Tool hat Berichten zufolge einen kompletten Plattformausfall bei Vercel verursacht und auf Hacker News mit 66 Punkten und 24 Kommentaren für erhebliche Diskussionen gesorgt.

MCPwner AI-Pentesting-Tool entdeckt mehrere 0-Day-Schwachstellen in OpenClaw
MCPwner, ein MCP-Server, der KI-Agenten für automatisierte Penetrationstests orchestriert, identifizierte mehrere kritische 0-Day-Schwachstellen in OpenClaw, darunter Umgebungsvariablen-Injektion, Berechtigungsumgehung und Informationsoffenlegung, die Standard-Scanner übersahen.

OpenClaw-Sicherheitslücken: Kritische Framework-Schwachstellen am 28.03.2026 gepatcht.
Das Ant AI Security Lab identifizierte 33 Schwachstellen im Kernframework von OpenClaw, wobei 8 kritische Probleme im Release 2026.3.28 behoben wurden. Die Schwachstellen umfassen Sandbox-Umgehung, Rechteausweitung, Sitzungsfortbestand nach Token-Widerruf, SSRF-Risiken und Allowlist-Degradation.