Verificación de precios de DeepSeek V4: 178 veces más barato en tokens cacheados frente a Opus, pero se reconoce retraso en capacidades

DeepSeek V4 se lanzó con precios tan bajos que un usuario de Reddit verificó los cálculos. Estos son los números confirmados:
Desglose de precios
- Entrada estándar de V4-Pro: $0.145 por millón de tokens. Entrada de Opus 4.7: ~$5 por millón. Proporción: 34x.
- Con un 75% de descuento promocional (hasta finales de mayo): la entrada de V4-Pro baja a $0.036 por millón, 138 veces más barato que Opus.
- Precio de acierto de caché: V4-Pro es $0.0036 por millón. Opus en caché es $0.625 por millón. Proporción: 173x.
El inconveniente
Como señala la publicación original, DeepSeek admite que V4 está tres a seis meses por detrás de GPT-5.4 y Gemini 3.1 Pro en capacidad. No obtienes calidad de frontera a un precio de frontera dividido por 178, sino la calidad de frontera del verano pasado.
Lo que esto significa para flujos de trabajo agentivos
Para bucles agentivos con mucho caché (prompts de sistema, definiciones de herramientas), el descuento por acierto de caché es la verdadera historia. Los prompts de sistema reutilizables se vuelven esencialmente gratuitos. La incógnita clave: si la ventana de contexto declarada de 1M se mantiene bajo cargas de trabajo reales o se degrada a unos 200K utilizables, como se ha visto en muchos modelos con ventanas grandes.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

El tráfico del subreddit r/ClaudeAI se dispara de 500.000 a 1,9 millones de visitantes semanales
El subreddit r/ClaudeAI creció de aproximadamente 250.000 visitantes semanales en noviembre de 2025 a 1,9 millones en marzo de 2026, manteniéndose el número de suscriptores en torno a 85.000 usuarios.

La filtración del código fuente de Claude revela el sistema de memoria autoDream y los patrones multiagente.
Anthropic envió accidentalmente el código fuente TypeScript de Claude Code en los mapas de fuente de npm, revelando la consolidación de memoria autoDream, la arquitectura modular de prompts del sistema y los patrones de coordinación multiagente.

Anthropic cambia los términos de suscripción, los usuarios de OpenClaw ahora facturados por separado por el uso de agentes
Anthropic ha restringido las suscripciones Claude Max para cubrir solo superficies de primera parte como Claude.ai y Claude Code, y ahora todo el uso de agentes de terceros se factura como 'Uso Extra' por token. Los usuarios tienen cuatro opciones: mantenerse en Max y pagar extra, cambiarse a la API de Anthropic, cambiar de proveedor o usar enrutamiento inteligente con Manifest.

Usuarios de Anthropic Claude Informan Restricción Silenciosa de Funciones en Cuentas de Pago
Un suscriptor pagador de Claude informa que la ejecución de shell/bash dejó de funcionar en todas las sesiones sin notificación, con restricciones integradas en el prompt del sistema a nivel de despliegue. El usuario presentó múltiples tickets de soporte y formularios de apelación pero no recibió respuesta mientras continuaba siendo facturado.