DeepSeek V4 Flash 비용 분석: 캐시 적중률과 가격 비율 설명

Reddit 사용자가 OpenClaw(PI 에이전트 루프 사용)와 OpenRouter에서 실행된 922개의 에이전트 태스크 트레이스를 분석하여 DeepSeek V4 Flash와 Opus 4.7을 비교했습니다. 비용 차이는 놀랍습니다: DeepSeek는 태스크당 $0.01인 반면 Opus는 $1.52로, 유사한 토큰 수(평균 ~962K)와 도구 호출(평균 ~14)에도 불구하고 큰 차이를 보입니다. 가격 비율은 0.0066배로, 입력 토큰 가격만으로 예상된 0.03배보다 훨씬 낮습니다.
DeepSeek가 더 저렴한 이유: 캐시 적중률 및 읽기/쓰기 가격
격차를 설명하는 두 가지 요인:
- 캐시 적중률: DeepSeek V4 Flash는 97%를 달성한 반면 Opus 4.7은 87%였습니다. 이러한 캐시 읽기-쓰기 가격 비율에서 캐시 적중률이 1% 높을수록 전체 비용이 약 20% 낮아집니다. DeepSeek의 10% 우위는 총 비용의 약 2/3를 절감합니다.
- 캐시 읽기-쓰기 가격 비율: DeepSeek의 비율은 0.02(캐시 읽기 비용이 캐시 미스 쓰기의 2%)인 반면, Opus는 0.08로 OpenAI, Anthropic, Gemini(0.08~0.10)와 비슷합니다. 이 요소만으로도 비용이 절반으로 줄어듭니다.
종합 효과
태스크당 유사한 토큰과 도구를 사용할 때, DeepSeek의 총 비용은 Opus의 0.0066배입니다. 사용자는 이러한 효율성이 인프라 또는 모델 아키텍처 수준(예: 더 나은 캐싱 전략)에서 설계된 것으로 추측합니다. 정확한 메커니즘은 공개되지 않았습니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

Anthropic, Claude 커뮤니티 앰버서더 프로그램 출범
Anthropic이 Claude 커뮤니티 앰배서더 프로그램을 출시했습니다. 이 프로그램은 지역 개발자 모임을 조직하고 전 세계의 빌더들을 연결하기 위한 자원을 제공합니다. 이 프로그램은 어떤 배경과 지역의 참가자들에게도 열려 있습니다.

클로드, 소매업체 간 제품 가격 검색 능력 상실
4월 27일부터 Claude는 Amazon, Best Buy, Newegg, B&H Photo에서 가격 정보를 더 이상 반환하지 않습니다. Walmart만이 여전히 가격을 표시하고 있습니다.

Chromebook에서 OpenClaw 실행 가능성 탐구
Chromebook에서 OpenClaw를 실행하는 것은 생각보다 쉬울 수 있습니다. OpenClawRadar의 최신 탐구는 사용자 경험과 요구 사항을 분석하여 Chromebook이 이 AI 코딩 에이전트를 처리할 수 있는지 알아봅니다.
엔비디아 AI 하드웨어 가격 인상 15% 이상, 고객들 타격
블룸버그 뉴스에 따르면, 엔비디아가 AI 관련 제품 가격을 15% 이상 인상했다고 고객들에게 통보했습니다. 이번 인상은 데이터센터 GPU와 네트워킹 장비에 적용되며, AI 개발 비용에 영향을 미칠 수 있습니다.