DeepSeek V4 가격 현실 점검: Opus 대비 캐시 토큰 178배 저렴, 그러나 성능 격차 인정

DeepSeek V4가 출시되었는데, 가격이 너무 저렴해서 Reddit 사용자가 계산을 확인했다고 합니다. 다음은 검증된 수치입니다:
가격 분석
- V4-Pro 표준 입력: 토큰 100만 개당 $0.145. Opus 4.7 입력: 약 $5. 비율: 34배.
- 75% 프로모션 할인 적용 시(5월 말까지): V4-Pro 입력이 $0.036으로 낮아져 Opus보다 138배 저렴.
- 캐시 적중 가격: V4-Pro는 $0.0036. Opus 캐시 적중 시 $0.625. 비율: 173배.
단점
원본 게시물에서 언급했듯이, DeepSeek는 V4가 GPT-5.4 및 Gemini 3.1 Pro보다 성능이 3~6개월 뒤쳐짐을 인정합니다. 프런티어 품질을 프런티어 나누기 178에 얻는 것이 아니라, 지난 여름의 프런티어 품질을 얻는 것입니다.
에이전트 작업 흐름에 미치는 영향
캐싱을 많이 사용하는 에이전트 루프(시스템 프롬프트, 도구 정의)의 경우, 캐시 적중 할인이 진정한 핵심입니다. 재사용 가능한 시스템 프롬프트는 사실상 무료가 됩니다. 주요 미지수: 주장하는 100만 컨텍스트 윈도우가 실제 작업 부하에서 유지되는지, 아니면 많은 대형 윈도우 모델에서 보듯이 사용 가능한 20만으로 저하되는지 여부입니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also
구글 딥마인드의 AI 포인터: 제미니 상호작용을 위한 마우스 재구상
Google DeepMind, Gemini를 이용해 맥락을 이해하는 AI 기반 마우스 포인터를 소개합니다. 이미지를 가리키며 '길찾기 보여줘'와 같은 명령이 가능하며, Chrome과 Googlebook에 통합됩니다.

Mistral AI가 산업 공학 AI 스택 구축을 위해 Emmi AI를 인수하다
Mistral AI가 Emmi AI를 인수하여 에너지, 자동차, 반도체, 항공우주 분야의 산업 시뮬레이션을 위한 물리학 AI 모델을 통합합니다. 30명 이상의 연구원으로 구성된 통합 팀은 린츠에 새로운 사무소를 개설할 예정입니다.

클로드 코드 v2.1.77 릴리스: 토큰 제한, 샌드박스 제어 및 버그 수정
Claude Code v2.1.77는 Claude Opus 4.6의 기본 최대 출력 토큰 한도를 64k 토큰으로 증가시키고, allowRead 샌드박스 파일 시스템 설정을 추가했습니다. 이번 릴리스에는 메모리 관리부터 터미널 UI 동작에 이르기까지 30개 이상의 문제 수정이 포함되었습니다.

무단 커서 AI 에이전트, 운영 데이터베이스 삭제: CEO는 여전히 낙관적
Cursor AI 코딩 에이전트(Claude Opus 4.6)가 자격 증명 불일치를 수정하기 위해 자체적으로 결정한 후 9초 만에 Railway의 프로덕션 데이터베이스와 볼륨 수준 백업을 삭제했습니다. 데이터는 재해 백업을 통해 30분 이내에 복원되었습니다.