Anthropic의 Claude Mythos AI 모델이 데이터 유출로 공개되었으며, '능력의 단계적 변화'로 묘사되었습니다.

유출된 내용
보안이 취약한 공개 검색 가능 데이터 저장소에서 유출된 데이터에 따르면 Anthropic이 'Claude Mythos'라는 새로운 AI 모델을 개발 및 테스트 중인 것으로 나타났습니다. 이 유출에는 Anthropic 블로그에 연결된 약 3,000개의 미공개 자산이 포함되어 있었으며, 여기에는 새 모델을 발표하는 것으로 보이는 블로그 게시물 초안도 포함되어 있었습니다.
출처에서 확인된 모델 세부 정보
유출된 문서에 따르면:
- 모델은 "Claude Mythos"라고 불리며 "Capybara"라고도 지칭되며, Anthropic은 이를 "새로운 계층의 모델에 대한 새로운 이름: 우리의 Opus 모델보다 더 크고 더 지능적"이라고 설명합니다.
- Capybara는 Anthropic의 모델 계층 구조에서 Opus 위의 새로운 계층을 나타냅니다(현재 Opus가 가장 크고/가장 능력이 뛰어나고, Sonnet이 더 빠르고/저렴하며, Haiku가 가장 작고/가장 빠릅니다).
- Claude Opus 4.6과 비교하여 Capybara는 "소프트웨어 코딩, 학술 추론, 사이버 보안 테스트를 포함한 다른 테스트에서 극적으로 높은 점수"를 얻습니다.
- 초안 블로그 게시물은 Claude Mythos를 "지금까지 우리가 개발한 가장 강력한 AI 모델"이라고 설명합니다.
- Anthropic은 이 모델을 "단계적 변화이자 지금까지 우리가 구축한 가장 능력 있는 모델"로 간주합니다.
현재 상태 및 출시 계획
이 모델은 현재 "초기 접근 고객"을 대상으로 신중한 출시 전략의 일환으로 시험 중입니다. 출처 자료에 따르면:
- 모델은 실행 비용이 높으며 아직 일반 출시 준비가 되지 않았습니다.
- Anthropic은 모델의 강력한 능력으로 인해 "출시 방식을 신중하게 결정하고 있습니다".
- 회사는 "소규모 초기 접근 고객 그룹과 협력하여 모델을 테스트하고 있습니다".
- 유출은 또한 Anthropic이 대기업 고객에게 AI 모델을 판매하려는 노력의 일환으로 유럽에서 계획된 초대 전용 CEO 정상회의 세부 정보도 드러냈습니다.
보안 영향
초안 블로그 게시물은 회사가 Claude Mythos가 "전례 없는 사이버 보안 위험을 초래한다"고 믿고 있음을 나타냈습니다. 유출 자체는 Anthropic이 "콘텐츠 관리 시스템 구성에서의 인간 실수"로 인해 초안 콘텐츠가 공개적으로 접근 가능하게 된 결과라고 설명했습니다.
AI 코딩 에이전트를 사용하는 개발자를 위한 맥락
AI 코딩 도우미에 의존하는 개발자들에게 이 유출은 Anthropic으로부터 코딩 능력의 상당한 개선이 예고될 수 있음을 시사합니다. "소프트웨어 코딩 테스트에서 극적으로 높은 점수"라는 특정 언급은 Claude의 API와 통합되는 도구 및 워크플로에 영향을 미칠 수 있는 잠재적 발전을 나타냅니다.
📖 Read the full source: HN AI Agents
👀 See Also

펜타곤, 군사 AI 사용을 둘러싼 분쟁 속 앤트로픽에 최종 제안 전달
미국 국방부는 Anthropic에 클로드 AI 모델의 무제한 군사적 사용을 위한 최종 제안을 보냈으며, 금요일까지 완전한 접근 권한을 부여하지 않으면 군사 계약을 잃고 공급망 위험으로 분류될 수 있다는 마감 기한을 설정했습니다.

톨란의 AI 기반 엔지니어링 인터뷰 프로세스
Tolan은 엔지니어가 실제로 AI 코딩 에이전트와 함께 일하는 방식을 반영하도록 엔지니어링 인터뷰를 재설계했습니다. 후보자들은 Figma 스펙이나 간단한 명세서를 바탕으로 기능을 구축하는 데 몇 시간을 할애하며, Claude, Codex, Cursor 또는 Gemini와 같은 AI 도구를 사용합니다.

Qwen 3 8B는 어려운 과제에 대한 블라인드 동료 평가에서 더 큰 모델들을 능가합니다.
10개의 소규모 언어 모델을 대상으로 13개의 어려운 첨단 과제에 대한 블라인드 동료 평가에서, Qwen 3 8B는 6개 평가에서 1위를 차지했으며 13개 과제 중 12개에서 상위 3위 안에 들었습니다. 이는 파라미터 수가 최대 4배 많은 모델들을 능가하는 성과입니다. 평가 범위에는 분산 락 디버깅, Go 동시성 버그, SQL 최적화, 베이지안 의료 진단, 심슨의 역설, 애로우의 투표 정리, 생존자 편향 분석이 포함되었습니다.

졸업식장에서 AI 격려사에 야유한 졸업생들: 개발자 정서의 신호
대학 졸업생들이 졸업식에서 AI 열풍을 부추기는 연사들에게 야유를 보내며, AI가 일자리와 사회에 미치는 영향에 대한 광범위한 불안을 반영했습니다.