中国AI企业对美国企业发动恶意蒸馏活动:美国国防部CSA
미국 국방부의 Clinger-Cohen Act(CSA) 사무소는 중국 AI 기업들이 미국 기반 AI 기업들을 대상으로 한 악성 증류(distillation) 캠페인에 대한 사이버 보안 권고를 발표했습니다. 2026년 9월 8일에 게시된 PDF 보고서는 이러한 캠페인이 AI 시스템을 악용하여 모델 가중치와 독점 지식을 추출하는 방법을 설명합니다.
보고서의 주요 내용
- 캠페인 대상: 이 권고는 OpenAI, Anthropic, Google 등 주요 미국 AI 기업들을 증류 공격의 주요 대상으로 지목합니다.
- 방법론: 공격자는 API 액세스를 사용하여 대상 모델을 반복적으로 프롬프트하여 출력을 생성하고, 이를 경쟁 모델을 훈련하는 데 사용하여 승인 없이 증류된 지식을 효과적으로 훔칩니다.
- 특정 취약점: 보고서는 rate limiting이 없는
/v1/completions엔드포인트의 취약점을 언급하며, 이를 통해모델 추출 공격이 가능하다고 지적합니다. 또한 PyTorch 및 Hugging Face의 transformers와 같은 오픈소스 프레임워크의 공급망 손상 가능성을 경고합니다. - 완화 조치: 권장 사항에는 차등 프라이버시 구현, 출력 워터마킹 추가, API 호출에 대한 엄격한 rate limit 적용이 포함됩니다.
이 권고는 현재 18포인트와 17개의 댓글이 있는 HN 스레드에 이어 나왔습니다. 많은 댓글 작성자들은 증류가 AI 커뮤니티에서 알려진 위험임을 지적하지만, 미국 정부 기관이 그러한 캠페인을 중국 국가 지원 단체에 공식적으로 귀속시킨 것은 이번이 처음입니다.
이 보고서에는 침해 지표와 권장 탐지 메커니즘(예: 비정상적인 API 호출 볼륨 및 출력 분포의 이상 징후 모니터링)이 포함되어 있습니다. 또한 기업들이 증류 시도와 일치하는 패턴이 있는지 모델 액세스 로그를 감사할 것을 권고합니다.
AI API를 사용하는 개발자에게 이는 독점 모델을 보호하기 위해 강력한 로깅 및 이상 탐지의 필요성을 강조합니다.
📖 전체 소스 읽기: HN AI Agents
👀 See Also

오픈클로 에이전트를 위한 실용적인 보안 관행
레딧 게시글은 OpenClaw 사용자를 위한 특정 보안 관행을 설명하며, 업데이트 및 감사를 위한 예약 명령, 공유 채널에서 에이전트 접근 관리, API 키와 스킬 보안을 포함합니다.

보안 스캔 결과 AI 에이전트 find-skills 도구에서 심각도 높은 취약점 발견
AI 에이전트 설정에 보안 스캔을 실행한 개발자가 추가 스킬을 설치하는 데 사용한 find-skills 도구에서 높은 심각도의 취약점을 발견하여 생태계 안전에 대한 우려를 불러일으켰습니다.

KnightClaw: OpenClaw 에이전트를 위한 로컬 보안 확장
KnightClaw은 OpenClaw 에이전트에 도달하기 전에 메시지를 가로채는 드롭인 확장 프로그램으로, 8계층 하이브리드 탐지 시스템과 이그레스 리댁션을 제공합니다. 완전히 로컬에서 실행되며 원격 측정 데이터를 전송하지 않으며 MIT 라이선스를 따릅니다.

보안 감사 실험 결과, AI 에이전트 성능은 지식 접근성에 달려 있음
한 개발자가 동일한 Next.js 코드베이스에 대해 세 가지 다른 AI 접근법으로 보안 감사를 수행했습니다: Claude Code의 내장 검토는 1개의 치명적, 6개의 높음, 13개의 중간 수준 문제를 발견했고, 추가 컨텍스트 없이 AI 에이전트를 사용한 경우 1개의 치명적, 5개의 높음, 14개의 중간 수준 문제를, 10개의 전문 보안 서적을 제공한 AI 에이전트는 8개의 치명적, 9개의 높음, 10개의 중간 수준 문제를 발견했습니다.