Verificação de preços do DeepSeek V4: tokens em cache 178x mais baratos que Opus, mas defasagem de capacidade reconhecida

O DeepSeek V4 foi lançado com preços tão baixos que um usuário do Reddit verificou as contas. Aqui estão os números confirmados:
Detalhamento de preços
- Entrada padrão do V4-Pro: US$ 0,145 por milhão de tokens. Entrada do Opus 4.7: ~US$ 5 por milhão. Proporção: 34x.
- Com 75% de desconto promocional (até o final de maio): entrada do V4-Pro cai para US$ 0,036 por milhão — 138x mais barato que o Opus.
- Preço de cache hit: V4-Pro custa US$ 0,0036 por milhão. Opus em cache custa US$ 0,625 por milhão. Proporção: 173x.
A ressalva
Como observa o post original, a DeepSeek admite que o V4 está de três a seis meses atrás do GPT-5.4 e do Gemini 3.1 Pro em capacidade. Você não está obtendo qualidade de ponta a um preço de ponta dividido por 178 — está obtendo qualidade de ponta do verão passado.
O que isso significa para fluxos de trabalho agentivos
Para loops agentivos com cache intenso (prompts de sistema, definições de ferramentas), o desconto de cache hit é a verdadeira história. Prompts de sistema reutilizáveis tornam-se essencialmente gratuitos. A incógnita principal: se a janela de contexto de 1 milhão de tokens se mantém em cargas de trabalho reais ou degrada para 200 mil utilizáveis, como visto em muitos modelos de janela grande.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Agentes Gerenciados Claude Adiciona Sonhos, Resultados, Orquestração Multiagente e Webhooks
Sonhar é um processo programado de curadoria de memória que melhorou as taxas de conclusão de tarefas em aproximadamente 6x nos testes da Harvey. Resultados, orquestração multiagente e webhooks agora estão em beta público na Plataforma Claude.

Bug não documentado encontrado no código do computador de orientação da Apollo 11 usando IA e linguagem de especificação
Pesquisadores descobriram um bug de bloqueio de recurso no código de controle do giroscópio do Computador de Orientação Apollo que passou despercebido por 57 anos, usando a IA Claude e a linguagem de especificação Allium para analisar 130.000 linhas de código assembly.

Claude Opus 4.7 sofre com aumento de erros — Atualização
Uma atualização automática de status relata erros elevados no Claude Opus 4.7. Acompanhe o progresso na página do incidente e no megathread da comunidade.

Automatizando as Mídias Sociais com OpenClaw: Possibilidades e Debates
Uma discussão no Reddit explora o potencial de automatizar tarefas de mídia social usando o OpenClaw.