Meta-Anzeigen enthielten KI-generierte CSAM; Forscher fanden über 50 in der Anzeigenbibliothek

✍️ OpenClawRadar📅 Veröffentlicht: 6. August 2026🔗 Source
Meta-Anzeigen enthielten KI-generierte CSAM; Forscher fanden über 50 in der Anzeigenbibliothek
Ad

Meta hat bezahlte Anzeigen mit KI-generiertem Kindesmissbrauchsmaterial (CSAM) und Bildern von Minderjährigen mit sexuell anzüglichem Text geschaltet, so ein Bericht des Tech Transparency Project (TTP), der WIRED vorliegt. Über 50 Bild- und Videoanzeigen wurden in Metas Anzeigenbibliothek entdeckt, einige erreichten Tausende von Konten in den USA, Großbritannien und Europa.

Wichtigste Erkenntnisse

  • Anzeigen liefen von November 2024 bis August 2025 und zielten auf Männer in mehreren Ländern.
  • Eine Videoanzeige verwendete ein Thumbnail eines Kindes mit dem Text: „Realizing Deep Fantasies with Generation AI. There is so much more than what is shown, use your imagination." Beim Anklicken zeigten sich Erwachsene in sexuellen Handlungen, dann wurde das Gesicht des Kindes hinzugefügt.
  • Eine weitere Anzeige zeigte ein junges Mädchen mit gespreizten Beinen und dem Text „I can show you more."
  • Die meisten Anzeigen hatten eine geringe Reichweite, aber eine erreichte 2.563 Konten in Europa.
  • Anzeigen verlinkten zu "Nudify"- oder Entkleidungs-Apps.
  • TTP meldete die Ergebnisse an die NCMEC CyberTipline; NCMEC kommentiert Berichte nicht.

Meta entfernte die Anzeigen, nachdem WIRED Kontakt aufgenommen hatte. Ein Sprecher sagte, man arbeite aggressiv daran, solche Inhalte von der Plattform fernzuhalten, und wies darauf hin, dass viele Anzeigen eine geringe Reichweite hatten und einige älter sind als die neuen KI-Erkennungstools. Meta gibt an, im letzten Jahr über 36 Millionen Stücke von CSE-Inhalten entfernt zu haben und rechtliche Schritte gegen Entwickler von Nudify-Apps einzuleiten.

Allerdings fanden Forscher Stunden vor Veröffentlichung 30 weitere Anzeigen, einige davon live, nachdem Meta bereits alarmiert worden war. Dies deutet darauf hin, dass die KI-Erkennungssysteme nicht vollständig wirksam sind.

Ad

Implikationen für Entwickler

Dieser Vorfall unterstreicht die anhaltende Herausforderung, KI-generierte Inhalte in großem Maßstab zu moderieren. Für Entwickler, die KI-Moderation von Inhalten aufbauen, ist die wichtigste Erkenntnis die Notwendigkeit einer robusten Erkennung von synthetischem CSAM, das sich von traditionellem Bildmaterial unterscheiden kann. Die Tatsache, dass diese Anzeigen den Überprüfungsprozess von Meta passierten, deutet auf Lücken in der automatisierten und menschlichen Moderation hin.

📖 Lesen Sie die vollständige Quelle: HN AI Agents

Ad

👀 Siehe auch

OpenClaw Security: 13 praktische Schritte, um Ihren KI-Agenten abzusichern
Sicherheit

OpenClaw Security: 13 praktische Schritte, um Ihren KI-Agenten abzusichern

Ein Reddit-Beitrag skizziert 13 Sicherheitsmaßnahmen für OpenClaw-Installationen, darunter das Ausführen auf einem separaten Rechner, die Nutzung von Tailscale zur Netzwerkisolierung, das Sandboxing von Subagenten in Docker und die Konfiguration von Allowlists für Benutzerzugriff.

OpenClawRadar
Agent-Drift Sicherheitswerkzeug v0.1.2 veröffentlicht: Ein Fortschritt in der KI-Sicherheit
Sicherheit

Agent-Drift Sicherheitswerkzeug v0.1.2 veröffentlicht: Ein Fortschritt in der KI-Sicherheit

Das Agent-Drift Sicherheitsinstrument v0.1.2 ist jetzt verfügbar und bietet verbesserte Sicherheitsfunktionen für KI-Coding-Agenten. Dieses Update geht auf wichtige Sicherheitsherausforderungen in der Automatisierung ein.

OpenClawRadar
Claude Code Security Plugin: Integration von AppSec in den Entwickler-Workflow
Sicherheit

Claude Code Security Plugin: Integration von AppSec in den Entwickler-Workflow

Anthropic hat ein Sicherheitsleitfaden-Plugin für Claude Code veröffentlicht, das Schwachstellen während der Programmierung erkennt und behebt. Es steht allen Benutzern über den Plugin-Marktplatz zur Verfügung, nicht nur Enterprise. Diskutiert, ob dies ein leichter Assistent, eine ernsthafte AppSec-Ebene oder eine Brücke zu Claude Security wird.

OpenClawRadar
Werkzeugautoritätsinjektion in LLM-Agenten: Wenn Werkzeugausgaben die Systemabsicht überschreiben
Sicherheit

Werkzeugautoritätsinjektion in LLM-Agenten: Wenn Werkzeugausgaben die Systemabsicht überschreiben

Ein Forscher demonstriert 'Tool Authority Injection' in einem lokalen LLM-Agenten-Labor und zeigt, wie vertrauenswürdige Tool-Ausgaben auf Policy-Ebene autorisiert werden können, wodurch das Agentenverhalten stillschweigend geändert wird, während Sandbox und Dateizugriff sicher bleiben.

OpenClawRadar