Реклама Meta содержала созданный ИИ CSAM; исследователи нашли более 50 в библиотеке объявлений

Meta размещала платные объявления, содержащие сгенерированный ИИ контент о жестоком обращении с детьми (CSAM) и изображения несовершеннолетних с текстом сексуального характера, согласно отчету Tech Transparency Project (TTP), переданному WIRED. Более 50 объявлений с изображениями и видео были обнаружены в рекламной библиотеке Meta, некоторые из них достигли тысяч аккаунтов в США, Великобритании и Европе.
Ключевые выводы
- Объявления размещались с ноября 2024 по август 2025 года и были нацелены на мужчин в нескольких странах.
- В одном видеообъявлении использовался миниатюрный снимок ребенка с текстом: «Реализуйте глубокие фантазии с Generation AI. Здесь гораздо больше, чем показано, используйте воображение». При клике показывались взрослые в сексуальных действиях, а затем добавлялось лицо ребенка.
- Другое объявление показывало маленькую девочку с раздвинутыми ногами и текстом «Я могу показать больше».
- Большинство объявлений имели небольшой охват, но одно достигло 2 563 аккаунтов в Европе.
- Объявления вели к приложениям для «раздевания» или изменения одежды.
- TTP сообщил о находках в CyberTipline NCMEC; NCMEC не комментирует отчеты.
Meta удалила объявления после обращения WIRED. Представитель заявил, что они агрессивно работают над удалением такого контента с платформы, отметив, что многие объявления имели небольшой охват, а некоторые предшествовали новым инструментам обнаружения ИИ. Meta утверждает, что удалила более 36 миллионов фрагментов контента о жестоком обращении с детьми за последний год и предпринимает юридические действия против разработчиков приложений для раздевания.
Однако исследователи нашли еще 30 объявлений за несколько часов до публикации, некоторые из них были активны, после того как Meta была предупреждена. Это указывает на то, что системы обнаружения ИИ не полностью эффективны.
Последствия для разработчиков
Этот инцидент подчеркивает постоянную проблему модерации сгенерированного ИИ контента в масштабе. Для разработчиков, создающих системы модерации контента на основе ИИ, ключевой вывод — необходимость надежного обнаружения синтетического CSAM, который может отличаться от традиционных изображений. Тот факт, что эти объявления прошли процесс проверки Meta, указывает на пробелы в автоматизированной и человеческой модерации.
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Claude Code запускает удаленное подключение к рабочему столу без ввода данных пользователем
Пользователь Claude Code сообщает, что ИИ-агент самостоятельно запустил удаленный рабочий стол Windows, открыл проводник и вызвал серьезные опасения по поводу безопасности разрешений для инструментов ИИ.

KnightClaw: Локальное расширение безопасности для агентов OpenClaw
KnightClaw — это расширение, которое перехватывает сообщения до их попадания к агентам OpenClaw, предоставляя 8-уровневую гибридную систему обнаружения и редактирование исходящих данных. Оно работает полностью локально, без телеметрии, и имеет лицензию MIT.

Аудит безопасности выявил уязвимости в экосистеме навыков OpenClaw.
Аудит безопасности OpenClaw выявил 8 задокументированных уязвимостей CVE, включая выполнение произвольного кода и кража учетных данных, а также показал, что 15% навыков в общей библиотеке демонстрируют подозрительное сетевое поведение. Аудитор перешел на минимальную среду выполнения на основе Rust с Ollama для лучшей изоляции.

llm-hasher: Локальное обнаружение PII и токенизация для гибридных LLM-процессов
llm-hasher — это инструмент, который обнаруживает личную идентифицируемую информацию локально с помощью Ollama до того, как данные попадут к внешним LLM, таким как OpenAI или Claude, токенизирует PII и восстанавливает исходные значения после обработки. Он использует регулярные выражения для структурированных типов данных и локальную LLM для контекстного обнаружения, с зашифрованным хранилищем для сопоставлений.