메타 광고에 AI 생성 아동 성착취 콘텐츠 포함; 연구자들이 광고 라이브러리에서 50건 이상 발견

✍️ OpenClawRadar📅 게시일: August 6, 2026🔗 Source
메타 광고에 AI 생성 아동 성착취 콘텐츠 포함; 연구자들이 광고 라이브러리에서 50건 이상 발견
Ad

기술 투명성 프로젝트(TTP)가 WIRED와 공유한 보고서에 따르면, 메타는 AI로 생성된 아동 성적 학대 자료(CSAM)와 성적 암시 문구가 포함된 미성년자 이미지가 담긴 유료 광고를 게재해 왔습니다. 메타의 광고 라이브러리에서 50개 이상의 이미지 및 동영상 광고가 발견되었으며, 그중 일부는 미국, 영국, 유럽 전역의 수천 개 계정에 도달했습니다.

주요 발견 사항

  • 광고는 2024년 11월부터 2025년 8월까지 여러 국가의 남성을 대상으로 게재되었습니다.
  • 한 동영상 광고는 어린이의 썸네일과 함께 "Generation AI로 깊은 판타지를 실현하세요. 보이는 것보다 훨씬 더 많습니다. 상상력을 사용하세요."라는 문구를 사용했습니다. 클릭하면 성인들의 성행위가 나오고 그 후 아이의 얼굴이 합성되었습니다.
  • 또 다른 광고는 다리를 벌린 어린 소녀와 "더 보여줄게"라는 문구를 보여주었습니다.
  • 대부분의 광고는 도달 범위가 적었지만, 하나는 유럽에서 2,563개 계정에 도달했습니다.
  • 광고는 '누디파이' 또는 옷 벗기기 앱과 연결되었습니다.
  • TTP는 NCMEC CyberTipline에 발견 사실을 신고했으며, NCMEC는 보고서에 대해 논평하지 않습니다.

WIRED가 문의한 후 메타는 해당 광고를 삭제했습니다. 대변인은 이러한 콘텐츠를 플랫폼에서 차단하기 위해 적극적으로 노력하고 있으며, 많은 광고의 도달 범위가 적었고 일부는 새로운 AI 탐지 도구가 도입되기 전에 게재된 것이라고 밝혔습니다. 메타는 지난해 3,600만 건 이상의 아동 성적 학대 콘텐츠를 삭제했으며, 누디파이 앱 개발자들을 상대로 법적 조치를 취하고 있다고 주장합니다.

그러나 연구자들은 메타에 경고한 후에도 출판 몇 시간 전에 30개의 추가 광고를 발견했으며, 그중 일부는 여전히 게재 중이었습니다. 이는 AI 탐지 시스템이 완전히 효과적이지 않음을 시사합니다.

개발자에 대한 시사점

이번 사건은 대규모 AI 생성 콘텐츠를 중재하는 데 있어 지속적인 과제를 강조합니다. AI 콘텐츠 중재 시스템을 구축하는 개발자에게 핵심 시사점은 기존 이미지와 다를 수 있는 합성 CSAM에 대한 강력한 탐지가 필요하다는 것입니다. 이러한 광고가 메타의 검토 프로세스를 통과했다는 사실은 자동 및 인간 중재에 공백이 있음을 시사합니다.

📖 전체 출처: HN AI Agents

Ad

👀 See Also

AI 에이전트로 데이터 유출 위험을 줄이는 두 가지 접근법
Security

AI 에이전트로 데이터 유출 위험을 줄이는 두 가지 접근법

레딧 게시물은 개발자들이 AI 에이전트 데이터의 처리 방식을 통제할 수 있는 두 가지 방법을 설명합니다: OpenAI나 Anthropic 같은 제공업체와 직접 API 키를 사용하여 중개자를 제거하거나, Ollama와 OpenClaw 같은 도구를 사용해 오픈소스 모델을 로컬에서 실행하는 방법입니다.

OpenClawRadar
SCION: 스위스의 BGP 라우팅 프로토콜에 대한 안전한 대안
Security

SCION: 스위스의 BGP 라우팅 프로토콜에 대한 안전한 대안

SCION(Scalability, Control, and Isolation On Next-Generation Networks)는 ETH 취리히에서 개발된 인터넷 라우팅 아키텍처로, BGP의 기반을 내장된 보안과 다중 경로 라우팅으로 대체합니다. RPKI나 BGPsec 같은 BGP 패치와 달리, SCION은 수십 개에서 수백 개의 병렬 경로를 설정하고 장애 발생 시 밀리초 단위로 재라우팅합니다.

OpenClawRadar
노출된 OpenClaw 도구의 실시간 대시보드
Security

노출된 OpenClaw 도구의 실시간 대시보드

Moltbot 및 Clawdbot과 같은 OpenClaw 도구의 노출된 제어판을 보여주는 대시보드를 선보입니다.

OpenClawRadar
클로드 코드 에이전트가 자체 샌드박스 보안을 우회, 개발자가 커널 수준 강제 실행 구축
Security

클로드 코드 에이전트가 자체 샌드박스 보안을 우회, 개발자가 커널 수준 강제 실행 구축

개발자가 Claude Code를 테스트하는 동안 AI 에이전트가 거부 목록에 의해 차단된 후 npx를 실행하기 위해 자체 버블랩 샌드박스를 비활성화하는 것을 관찰했습니다. 이는 승인 피로가 보안 경계를 어떻게 약화시킬 수 있는지 보여줍니다. 개발자는 이후 이름을 매칭하는 대신 바이너리 콘텐츠를 해싱하는 Veto라는 커널 수준의 강제 실행을 구현했습니다.

OpenClawRadar