Anthropic API 결제 오류: 소넷 모델에 오픈스 요금이 부과됨

버그 상세 내용
Anthropic API의 claude-sonnet-4-6 모델에서 상당한 청구 불일치가 확인되었습니다. API는 응답에서 모델을 Sonnet으로 정확히 보고하지만, 실제 청구 계산은 Opus 가격을 사용하여 예상보다 높은 요금이 발생하고 있습니다.
원시 이벤트 데이터 증거
이 버그는 높은 토큰 요청과 강력한 프롬프트 캐싱을 분석하여 발견되었습니다. 원시 이벤트의 구체적인 데이터 포인트는 다음과 같습니다:
- 보고된 모델: claude-sonnet-4-6
- 입력 토큰: 6
- 출력 토큰: 4,034
- 캐시 생성(쓰기): 61,920 토큰
- 캐시 읽기: 171,391 토큰
- 청구된 totalCostUsd: $0.5735755
사용자는 이 총 비용이 Sonnet 가격이 아닌 Opus 가격에 정확히 일치한다고 지적했으며, 이로 인해 API 사용자에게 상당한 비용 차이가 발생하고 있습니다.
영향 및 배경
이 버그는 Anthropic Claude API를 Sonnet 모델과 함께 사용하는 개발자들에게 영향을 미칩니다. Opus는 Anthropic의 가장 비싼 모델 등급이므로, 이 불일치로 인해 예상보다 훨씬 높은 비용이 발생할 수 있습니다. 이 버그는 모델 선택 자체보다는 청구 계산 로직에 있는 것으로 보이며, API는 응답에서 모델을 Sonnet으로 정확히 식별합니다.
API 비용을 모니터링하는 개발자들에게 이는 현재 Sonnet 사용에 대한 청구 보고서가 부정확할 수 있음을 의미합니다. 이 문제는 ClaudeAI 서브레딧에 보고되었으며, 사용자들은 잠재적인 해결 방법을 논의하고 Anthropic의 공식 수정을 기다리고 있습니다.
📖 Read the full source: r/ClaudeAI
👀 See Also

분석: 클로드 코드 사용자에 대한 Anthropic의 실제 컴퓨팅 비용은 보고된 5,000달러 수치보다 훨씬 낮습니다.
최근 한 기사에서 Anthropic의 월 200달러 Claude Code Max 플랜이 컴퓨팅 비용으로 5,000달러를 소비한다는 주장을 분석한 결과, 실제 추론 비용은 OpenRouter의 경쟁적인 오픈 웨이트 모델과 비교할 때 API 가격의 약 10% 수준임을 발견했습니다.
Claude Code 2.1.233: GitLab MR 지원, 메모리 제한 및 보안 수정
Claude Code v2.1.233에 GitLab MR URL, Bash용 선택적 메모리 제한이 추가되었으며, NTLM 자격 증명 유출 및 CPU 스핀 문제가 수정되었습니다.

구글, '모든 합법적' AI 사용에 대한 기밀 국방부 계약 체결
Google은 미국 국방부가 자사의 AI 모델을 '합법적인 정부 목적'으로 사용할 수 있도록 허용하는 기밀 계약을 체결한 것으로 알려졌으며, 대규모 감시와 자율 무기에 대한 제한은 구속력 없는 합의에 불과하다고 The Information이 보도했다.

클로드 맥스 20배 플랜: 발표에도 불구하고 한도 증가 미적용 — 사용자가 수학으로 확인하다
월 200달러를 지불하는 Claude Max 20x 사용자가 Anthropic이 발표한 2배 세션 제한과 1.5배 주간 제한 증가가 자신의 계정에 적용되지 않았다고 보고했습니다. 수학적 증거를 제시하고 완전한 지원 응답 부재를 공유합니다.