AISI 평가, 클로드 미토스 프리뷰의 CTF 및 다단계 공격에서의 사이버 역량을 보여줍니다

AI 보안 연구소(AISI)가 Anthropic의 Claude Mythos Preview에 대한 사이버 평가를 수행하여, 캡처 더 플래그(CTF) 과제 및 다단계 공격 시뮬레이션에서의 성능을 평가했습니다. 이 모델은 사이버 보안 역량에서 이전의 최첨단 모델들에 비해 상당한 개선을 보였습니다.
캡처 더 플래그(CTF) 결과
모델이 숨겨진 플래그를 찾아내기 위해 취약점을 식별하고 악용해야 하는 CTF 과제에서, Mythos Preview는 전문가 수준 과제에서 73%의 성공률을 달성했습니다. 이 전문가 수준 과제들은 2025년 4월 이전에는 어떤 모델도 완료할 수 없었던 것들입니다. 평가는 기술 비전문가 수준부터 전문가 수준까지의 난이도에 걸쳐 성능을 비교했으며, 모델들은 최대 5천만 토큰의 토큰 예산을 사용하여 테스트되었습니다.
사이버 레인지 결과
AISI는 초기 정찰부터 전체 네트워크 장악까지 이어지는 32단계 기업 네트워크 공격 시뮬레이션인 'The Last Ones'(TLO)를 구축했으며, 인간이 완료하는 데 약 20시간이 소요될 것으로 추정됩니다. Claude Mythos Preview는 처음부터 끝까지 TLO를 해결한 최초의 모델로, 10번의 시도 중 3번 성공했습니다. 모든 시도에서, 이 모델은 평균 32단계 중 22단계를 완료했습니다.
Claude Opus 4.6는 다음으로 성능이 좋은 모델로, 평균 16단계를 완료했습니다. 평가는 최대 1억 토큰의 토큰 예산을 사용했으며, 성능은 이 한계까지 계속해서 증가했습니다.
한계점과 맥락
이 모델은 운영 기술(OT)에 초점을 맞춘 사이버 레인지 'Cooling Tower'를 완료하지 못했지만, OT 특정 부분보다는 IT 부분에서 막혔습니다. AISI는 2년 전에는 사용 가능한 최고의 모델들도 초보자 수준의 사이버 과제를 간신히 완료할 수 있었던 반면, 지금은 Mythos Preview가 명시적으로 지시를 받고 네트워크 접근 권한을 부여받은 통제된 평가 환경에서 취약한 네트워크에 대한 다단계 공격을 실행하고 취약점을 자율적으로 발견 및 악용할 수 있었다고 언급했습니다.
📖 Read the full source: HN AI Agents
👀 See Also

클로드는 특정 사용 사례에 대해 신원 확인을 구현합니다.
Anthropic는 Persona Identities를 통해 Claude에 대한 신원 확인을 도입하고 있으며, 정부 발급 사진 신분증과 실시간 셀카를 요구합니다. 확인 절차는 5분 미만이 소요되며, 남용 방지와 법적 의무 준수를 위해 사용됩니다.

SkillFence 소개: 스킬의 실제 동작을 감시하는 새로운 런타임 모니터
SkillFence는 AI 에이전트 동작 모니터링에 있어 혁신적인 돌파구를 제시하여, AI 기반 환경에서의 투명성과 보안 요구를 해결합니다. 이 혁신적인 도구가 자율적 프로세스에 대한 통제력을 어떻게 강화할 수 있는지 알아보세요.

클로드 미토스 프리뷰 출시 이후 CVE 심각도 급증 — 에포크 AI 데이터
Epoch AI는 2026년 6월, Anthropic의 Claude Mythos Preview와 Project Glasswing 발표 이후 21개 주요 조직에서 심각도 높은 CVE가 3.5배 급증했다고 보고했습니다.

FreeBSD 커널 kgssapi.ko 스택 버퍼 오버플로우를 통한 원격 코드 실행 취약점 (CVE-2026-4747)
FreeBSD의 kgssapi.ko 모듈에 존재하는 스택 버퍼 오버플로 취약점으로 인해 NFS 서버를 통해 원격 커널 RCE와 루트 셸 획득이 가능합니다. 이 취약점은 특정 패치가 적용되지 않은 FreeBSD 13.5, 14.3, 14.4, 15.0 버전에 영향을 미칩니다.