Explicação da Taxa de Acerto de Cache e Relação de Preço do DeepSeek V4 Flash

Um usuário do Reddit analisou 922 rastros de tarefas de agente executadas no OpenClaw (com loop de agente PI) e OpenRouter, comparando DeepSeek V4 Flash com Opus 4.7. A diferença de custo é impressionante: US$ 0,01 por tarefa para DeepSeek contra US$ 1,52 para Opus, apesar de contagens de tokens semelhantes (~962K em média) e chamadas de ferramentas (~14 em média). A relação de preço é 0,0066x, muito abaixo dos esperados 0,03x com base apenas no preço do token de entrada.
Por que DeepSeek é mais barato: Taxa de acerto de cache e preço de leitura/escrita
Dois fatores explicam a diferença:
- Taxa de acerto de cache: DeepSeek V4 Flash alcançou 97% contra 87% do Opus 4.7. Nessas relações de preço de leitura/escrita de cache, cada 1% a mais de acerto de cache reduz o custo total em ~20%. A vantagem de 10% da DeepSeek corta cerca de 2/3 do custo total.
- Relação de preço de leitura/escrita de cache: A relação da DeepSeek é 0,02 (leitura de cache custa 2% de uma escrita sem acerto), enquanto a Opus está em 0,08 — comparável à OpenAI, Anthropic e Gemini (0,08–0,10). Isso por si só reduz ainda mais o custo pela metade.
Como isso se acumula
Com tokens e ferramentas semelhantes por tarefa, o custo total da DeepSeek é 0,0066x o do Opus. O usuário especula que essas eficiências são projetadas no nível de infraestrutura ou arquitetura do modelo (por exemplo, melhor estratégia de cache). O mecanismo exato não é divulgado.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Testando Marketplaces de Agentes de IA: Resultados Práticos de ClawGig, RentAHuman e Configurações Baseadas em OpenClaw
Um desenvolvedor testou vários marketplaces de agentes de IA, descobrindo que o ClawGig tinha agentes não responsivos e pontuações de reputação manipuladas, os agentes do RentAHuman não conseguiam manter conversas coerentes, enquanto configurações independentes baseadas no OpenClaw mostraram potencial, mas careciam de visibilidade.

Claude Code v2.1.196: Modelos Padrão da Organização, Correção de Segurança, Recuperação de Tarefas em Segundo Plano
Claude Code v2.1.196 adiciona modelos padrão da organização, corrige um problema de segurança com a inicialização de servidores MCP, melhora a confiabilidade de sessões em segundo plano e reduz o uso de tokens no /code-review em 25%.

Claude Code v2.1.199 Corrige Mais de 20 Bugs: SSL, Subagentes, Falhas do Daemon Corrigidas
Claude Code v2.1.199 corrige erros de certificado SSL, falhas silenciosas de subagentes, um loop de travamento do daemon Linux e mais de 20 outros bugs. As principais correções incluem dicas imediatas de erro SSL, retenção parcial de stream e propagação de erros de subagentes.

Guia Semanal de Sobrevivência do r/ClaudeAI: Opus 4.7, Bug de Cobrança e Incidente de Exclusão de Banco de Dados
O Guia de Sobrevivência Semanal de Wilson destila as principais discussões do r/ClaudeAI (50+ comentários) em lições práticas: debate sobre Opus 4.7, um bug de cobrança de $200 acionado por um nome de arquivo no git, um agente de IA que deletou um banco de dados inteiro em 9 segundos, e o aumento de 9x nos preços dos modelos Claude no Copilot.