클로드 소넷 4.6 공개: 향상된 코딩 및 컴퓨터 사용 능력

Anthropic은 코딩, 컴퓨터 사용, 장문 추론 등에서 상당한 향상을 보여주는 소넷 모델 라인의 최신 버전인 클로드 소넷 4.6을 발표했습니다. 새로운 기능 중 핵심은 현재 베타 상태인 100만 토큰 컨텍스트 창으로, 전체 코드베이스나 긴 문서와 같은 방대한 데이터를 처리하는 능력을 확장합니다.
소넷 4.6은 이제 claude.ai와 Claude Cowork에서 무료 및 프로 플랜 구독자를 위한 기본 모델이 되었으며, 토큰 100만 개당 가격은 소넷 4.5와 동일하게 3달러/15달러부터 시작합니다. 초기 접근 개발자들은 지시 따르기, 일관성, 작업 실행에서 현저한 개선을 확인했으며, 많은 실제 작업에서 2025년 11월의 클로드 오푸스 4.5보다 소넷 4.6을 선호한다고 밝혔습니다.
컴퓨터 사용 능력 측면에서 소넷 4.6은 2024년 10월 클로드의 첫 범용 컴퓨터 사용 모델 출시 이후의 진전을 기반으로 합니다. 이 모델은 특수 연결 장치 없이 마우스와 키보드 같은 가상 인터페이스를 사용해 인간처럼 소프트웨어와 상호작용합니다. AI 컴퓨터 사용의 표준인 OSWorld 벤치마크는 스프레드시트 탐색과 웹 양식 작성 같은 복잡한 작업에서 거의 인간 수준의 능력을 보여주며 그 발전을 확인시켜 줍니다.
보안 역시 중점 사항으로, 소넷 4.6은 프롬프트 주입 공격에 대한 향상된 복원력을 나타내는 광범위한 안전 평가를 거쳤으며, 이 점에서 오푸스급 모델에 필적합니다. 시스템 카드와 API 문서는 이러한 안전 강화에 대한 더 자세한 내용과 지침을 제공합니다.
📖 전체 출처 읽기: HN AI Agents
👀 See Also

연구에 따르면 AI 사용자들은 종종 LLM의 답변을 확인 없이 수용하는 것으로 나타났습니다.
펜실베이니아 대학교 연구에서 AI 사용자들이 '인지적 항복'을 보이며, LLM 답변을 최소한의 검증 없이 수용한다는 사실을 발견했습니다. 실험에서 사용자들은 AI가 절반의 시간 동안 틀렸음에도 불구하고, 정확한 AI 답변을 93%의 확률로, 틀린 답변을 80%의 확률로 수용했습니다.

Andrej Karpathy, Anthropic의 사전 학습 팀에 합류하여 클로드를 사용한 순환적 자기 개선 추진
OpenAI 공동 창업자였던 안드레 카파시(Andrej Karpathy)가 Anthropic의 사전 학습 팀에 합류해, Nick Josef 밑에서 Claude를 이용해 사전 학습 연구를 가속화하고 재귀적 자기 개선을 가능하게 하는 새로운 팀을 구축합니다.
AI 산업이 데이터 센터 구축을 정당화하려면 2031년까지 연간 6조 달러의 수익이 필요하다
분석가들은 AI 산업이 현재의 데이터센터 자본지출을 정당화하려면 2031년까지 연간 약 6조 달러의 매출을 올려야 한다고 말한다. HN의 303개 댓글 스레드는 그 계산을 낱낱이 파헤친다.

케임브리지 연구진, 저에너지 AI 칩용 하프늄 산화물 멤리스터 개발 이 번역은 다음과 같은 특징을 포함합니다: 1. "Cambridge researchers" → "케임브리지 연구진" (자연스러운 한국어 학술 표현) 2. "develop" → "개발" (기술 개발에 적합한 동사) 3. "hafnium oxide memristor
케임브리지 대학 연구진이 기존 산화물 기반 장치보다 전류 스위칭 속도가 백만 배 낮은 하프늄 산화물 기반 멤리스터를 개발하여 AI 하드웨어 에너지 사용량을 최대 70%까지 줄일 수 있는 가능성을 제시했습니다.