Verificación de precios de DeepSeek V4: 178 veces más barato en tokens cacheados frente a Opus, pero se reconoce retraso en capacidades

✍️ OpenClawRadar📅 Publicado: 29 de abril de 2026🔗 Source
Verificación de precios de DeepSeek V4: 178 veces más barato en tokens cacheados frente a Opus, pero se reconoce retraso en capacidades
Ad

DeepSeek V4 se lanzó con precios tan bajos que un usuario de Reddit verificó los cálculos. Estos son los números confirmados:

Desglose de precios

  • Entrada estándar de V4-Pro: $0.145 por millón de tokens. Entrada de Opus 4.7: ~$5 por millón. Proporción: 34x.
  • Con un 75% de descuento promocional (hasta finales de mayo): la entrada de V4-Pro baja a $0.036 por millón, 138 veces más barato que Opus.
  • Precio de acierto de caché: V4-Pro es $0.0036 por millón. Opus en caché es $0.625 por millón. Proporción: 173x.

El inconveniente

Como señala la publicación original, DeepSeek admite que V4 está tres a seis meses por detrás de GPT-5.4 y Gemini 3.1 Pro en capacidad. No obtienes calidad de frontera a un precio de frontera dividido por 178, sino la calidad de frontera del verano pasado.

Ad

Lo que esto significa para flujos de trabajo agentivos

Para bucles agentivos con mucho caché (prompts de sistema, definiciones de herramientas), el descuento por acierto de caché es la verdadera historia. Los prompts de sistema reutilizables se vuelven esencialmente gratuitos. La incógnita clave: si la ventana de contexto declarada de 1M se mantiene bajo cargas de trabajo reales o se degrada a unos 200K utilizables, como se ha visto en muchos modelos con ventanas grandes.

📖 Lee la fuente completa: r/LocalLLaMA

Ad

👀 Ver también

Gemma 4 31B supera a modelos más grandes en FoodTruck Bench.
Noticias

Gemma 4 31B supera a modelos más grandes en FoodTruck Bench.

Gemma 4 31B ocupó el tercer lugar en el benchmark FoodTruck Bench, superando a GLM 5, Qwen 3.5 397B y todos los modelos Claude Sonnet. El modelo parece manejar mejor las tareas de largo plazo y sigue sus propios consejos de planificación.

OpenClawRadar
Agente Hermes + Qwen3.6 27b Local maneja tareas de administrador de TI junior
Noticias

Agente Hermes + Qwen3.6 27b Local maneja tareas de administrador de TI junior

Un veterano de TI con 30 años de experiencia informa que Qwen3.6 27b ejecutándose en el arnés Hermes Agent completó una lista de tareas para un administrador de TI junior en 1.5 horas, incluyendo parcheo, instalación de Docker y configuración de servicios.

OpenClawRadar
El modelo MiniMax M2.7 muestra un rendimiento sólido como agente de codificación con IA.
Noticias

El modelo MiniMax M2.7 muestra un rendimiento sólido como agente de codificación con IA.

Un desarrollador probó MiniMax M2.7 como su principal agente de IA para programación y descubrió que superó a GPT 5.4 y Gemini 3.1 Pro en velocidad y tareas de herramientas, con puntuaciones de referencia del 56,22% en SWE-Pro y del 57,0% en Terminal Bench 2.

OpenClawRadar
Actualización de estado de Claude: Tasas de error elevadas para Opus 4.6 y Sonnet 4.6
Noticias

Actualización de estado de Claude: Tasas de error elevadas para Opus 4.6 y Sonnet 4.6

Una actualización oficial del estado del sistema Claude reporta tasas de error elevadas para los modelos Opus 4.6 y Sonnet 4.6, con un incidente registrado el 2026-03-31T21:10:28.000Z. La publicación automática dirige a los usuarios a verificar el estado de resolución y los informes de rendimiento de la comunidad.

OpenClawRadar