Verificação de preços do DeepSeek V4: tokens em cache 178x mais baratos que Opus, mas defasagem de capacidade reconhecida

O DeepSeek V4 foi lançado com preços tão baixos que um usuário do Reddit verificou as contas. Aqui estão os números confirmados:
Detalhamento de preços
- Entrada padrão do V4-Pro: US$ 0,145 por milhão de tokens. Entrada do Opus 4.7: ~US$ 5 por milhão. Proporção: 34x.
- Com 75% de desconto promocional (até o final de maio): entrada do V4-Pro cai para US$ 0,036 por milhão — 138x mais barato que o Opus.
- Preço de cache hit: V4-Pro custa US$ 0,0036 por milhão. Opus em cache custa US$ 0,625 por milhão. Proporção: 173x.
A ressalva
Como observa o post original, a DeepSeek admite que o V4 está de três a seis meses atrás do GPT-5.4 e do Gemini 3.1 Pro em capacidade. Você não está obtendo qualidade de ponta a um preço de ponta dividido por 178 — está obtendo qualidade de ponta do verão passado.
O que isso significa para fluxos de trabalho agentivos
Para loops agentivos com cache intenso (prompts de sistema, definições de ferramentas), o desconto de cache hit é a verdadeira história. Prompts de sistema reutilizáveis tornam-se essencialmente gratuitos. A incógnita principal: se a janela de contexto de 1 milhão de tokens se mantém em cargas de trabalho reais ou degrada para 200 mil utilizáveis, como visto em muitos modelos de janela grande.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

ICML 2026 rejeita 2% dos artigos por violação da política de revisão por LLM
A ICML 2026 rejeitou 497 artigos (aproximadamente 2% das submissões) após detectar 795 avaliações (cerca de 1% de todas as avaliações) em que os revisores violaram acordos explícitos de não usar LLMs. O método de detecção envolveu a marcação d'água de PDFs com instruções ocultas para LLMs.

O Easter Egg /buddy do Claude Code e Solicitações de Funcionalidades dos Usuários
O Claude Code inclui um comando oculto /buddy que cria um companheiro estilo Tamagotchi com espécies, estatísticas e comentários decorativos. Um assinante Max com mais de 840 sessões detalhou as limitações atuais e propôs melhorias funcionais.

LeMario: Treinando um Modelo Mundial JEPA em Super Mario Bros — Guia Técnico e Análise Pós-Morte
Benjamin Bai reproduz a arquitetura JEPA do LeWorldModel do zero e a treina no Super Mario Bros. O modelo prevê futuros de cinco passos, mas falha no planejamento de longo prazo — uma análise técnica detalhada.

Mark Zuckerberg Desenvolve Agente de IA para Assistência a CEOs
Mark Zuckerberg está construindo um agente de IA para auxiliar nas responsabilidades de CEO, de acordo com um relatório do Wall Street Journal discutido no Hacker News com 37 pontos e 30 comentários.