클로드 오푸스 4.6과 소넷 4.6이 이제 표준 가격으로 100만 컨텍스트를 제공합니다

지금 이용 가능한 기능
Claude Opus 4.6과 Sonnet 4.6은 이제 Claude 플랫폼에서 표준 가격으로 완전한 100만 컨텍스트 창을 포함합니다. 표준 가격은 전체 창에 적용됩니다 — Opus 4.6은 100만 토큰당 $5/$25, Sonnet 4.6은 $3/$15입니다. 승수는 없습니다: 900K 토큰 요청은 9K 토큰 요청과 동일한 토큰당 요금으로 청구됩니다.
일반 출시와 함께 변경된 주요 사항
- 장문 컨텍스트 프리미엄 없이 전체 컨텍스트 창에 대해 하나의 가격 적용
- 모든 컨텍스트 길이에서 완전한 속도 제한 — 표준 계정 처리량이 전체 창에 적용
- 요청당 6배 더 많은 미디어: 최대 600개의 이미지 또는 PDF 페이지 (기존 100개에서 증가)
- 오늘부터 Claude 플랫폼 기본, Microsoft Azure Foundry, Google Cloud의 Vertex AI에서 이용 가능
- 베타 헤더 불필요 — 20만 토큰 이상의 요청이 자동으로 작동
- 이미 베타 헤더를 보내고 있다면 무시되므로 코드 변경이 필요 없음
Claude Code와의 통합
100만 컨텍스트는 이제 Opus 4.6을 사용하는 Max, Team, Enterprise 사용자를 위한 Claude Code에 포함됩니다. Opus 4.6 세션은 자동으로 전체 100만 컨텍스트 창을 사용할 수 있어, 압축이 줄어들고 대화 내용이 더 많이 유지됩니다.
성능 벤치마크
Opus 4.6은 MRCR v2에서 78.3%의 점수를 기록하며, 해당 컨텍스트 길이에서 최고 수준의 프론티어 모델입니다. Claude Opus 4.6과 Sonnet 4.6은 전체 100만 창에서 정확도를 유지합니다. 장문 컨텍스트 검색은 각 모델 세대마다 개선되었습니다.
개발자를 위한 실질적 의미
이는 전체 코드베이스, 수천 페이지의 계약서, 또는 장기 실행 에이전트의 전체 추적 — 도구 호출, 관찰, 중간 추론 — 을 로드하고 직접 사용할 수 있음을 의미합니다. 이전에 장문 컨텍스트 작업에 필요했던 엔지니어링 작업, 손실 요약, 컨텍스트 정리는 더 이상 필요하지 않습니다.
사용자 피드백에 따르면:
- 소프트웨어 엔지니어들은 컨텍스트를 잃지 않고 하나의 창에서 검색, 재검색, 에지 케이스 집계, 수정 제안을 모두 수행할 수 있다고 보고
- 팀은 압축 이벤트가 15% 감소했으며, 에이전트가 컨텍스트를 유지하고 초기 내용을 잊지 않고 몇 시간 동안 실행될 수 있음을 확인
- 에이전트 시스템은 이제 청킹 없이 전체 차이를 처리할 수 있어, 더 간단하고 토큰 효율적인 하네스에서 더 높은 품질의 리뷰가 가능
- 과학 연구 시스템은 수백 편의 논문, 증명, 코드베이스를 단일 패스로 통합할 수 있음
📖 전체 소스 읽기: HN AI Agents
👀 See Also

AI水印在文本中始终容易被移除
EU AI 법은 2026년까지 텍스트 워터마크를 요구하지만, 그것은 항상 제거 가능할 것입니다. 그 이유와 SynthID의 작동 방식입니다.

API 요구 사항에 맞는 최적의 토큰 제공자 선택하기
OpenClaw 커뮤니티의 인사이트를 바탕으로 AI 코딩 및 자동화에서 토큰과 API 제공자를 선택할 때 고려해야 할 핵심 요소를 살펴보세요.

Qwen3.6 Plus 벤치마크 서양 최신 모델 대비 비교
Qwen3.6 Plus는 SWE-bench Verified에서 78.8점, GPQA/GPQA Diamond에서 90.4점, HLE(도구 없음)에서 28.8점, MMMU-Pro에서 78.8점을 기록하며 GPT-5.4, Claude Opus 4.6, Gemini 3.1 Pro Preview와 같은 모델들과 경쟁력을 보였습니다.

위험하게 코드 읽기를 건너뛰는 경우: LLM이 코드를 읽는 속도보다 빠르게 코드를 작성할 때
AI가 생성한 코드 검토를 중단하고, 대신 명세와 테스트에 엄격함을 적용하면 어떨까? LLM 출력을 기계어처럼 취급하자는 생각입니다.