Anthropic, 중국 연구소들의 산업 규모 Claude AI 데이터 추출을 공개합니다

Anthropic은 Claude AI를 대상으로 한 대규모 데이터 추출 작업에 대한 세부 정보를 공개적으로 공개했습니다. 상황을 분석한 Reddit 게시물에 따르면, 이는 고립된 연구 활동이 아니라 여러 중국 AI 기업이 참여한 산업 수준의 노력이었습니다.
침해 규모
이 작업에는 세 개의 특정 주체가 관여했습니다: DeepSeek, Moonshot AI, 그리고 MiniMax입니다. 이 연구소들은 Claude의 API에 접근하기 위해 24,000개 이상의 사기 계정을 생성했습니다. 이러한 계정을 통해 그들은 자체 모델을 훈련시키기 위해 Claude에서 1,600만 건 이상의 교환을 긁어냈습니다.
합법적 증류와 불법적 증류의 구분
원본 자료는 표준 산업 관행과 여기서 발생한 일 사이의 차이점을 명확히 합니다:
- 표준 증류: 상업 고객을 위해 더 작고 효율적인 버전을 훈련시키기 위해 대형 모델 사용
- 불법적 증류: "능력 세탁"으로 묘사됨 - 미국 모델로부터 안전 장치와 논리 구조를 빼내어 외국 군사, 정보 및 감시 시스템에 직접 공급
더 넓은 함의
Anthropic은 이러한 공격이 점점 더 정교해지고 빈번해지고 있다고 경고하고 있습니다. API 사용의 "명예 시스템"은 그러한 작업을 방지하기에 불충분한 것으로 보입니다. 회사는 주요 AI 업체와 정책 입안자들 사이의 조정된 방어 조치를 요구하고 있습니다.
이 상황은 기존 안전 장치가 있더라도 API 엔드포인트를 통해 노출되면 모델 가중치가 얼마나 취약한지 강조합니다.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

코드월 AI 에이전트, 맥킨지의 릴리 플랫폼에서 치명적 취약점 발견
CodeWall의 자율 공격형 AI 에이전트가 2시간 만에 McKinsey의 내부 Lilli AI 플랫폼 데이터베이스에 대한 전체 읽기/쓰기 접근 권한을 획득하여 SQL 인젝션 및 IDOR 취약점을 통해 4,650만 건의 채팅 메시지, 728,000개의 파일, 민감한 시스템 구성을 노출시켰습니다.

Axios 백도어를 통한 NPM 침해: AI 코딩 에이전트에 미치는 영향
2026년 3월 31일, 북한과 연관된 위협 행위자가 3시간 동안 npm을 해킹하여 악성 코드가 삽입된 Axios 버전(1.14.1 및 0.30.4)을 배포했습니다. 이 악성 코드는 플랫폼별 RAT를 다운로드하는 종속성을 주입하고, 자격 증명을 수집한 후 자가 삭제되었습니다. Claude Code 및 Cursor와 같은 AI 코딩 에이전트는 자동 npm 설치로 인해 특히 취약했습니다.

Fil-C가 setjmp/longjmp와 ucontext를 메모리 안전하게 만듦
Fil-C는 메모리 안전성을 제공하는 C 방언으로, 스택 손상이나 매달린 포인터 없이 setjmp/longjmp와 ucontext API를 구현하여 일반적인 오용으로 인한 충돌이나 악용을 방지합니다.

중요한 동료 작업 버그: AI 에이전트가 사용자 승인 없이 파일 삭제
클로드의 협업 모드에서 발견된 치명적인 버그로 인해 AI가 사용자의 동의 없이 파괴적인 작업을 실행할 수 있었습니다. ExitPlanMode 도구가 사용자의 승인을 잘못 보고하여, 자율 에이전트를 작동시켜 React/TypeScript 코드베이스에서 12개의 파일을 삭제했습니다.