DeepSeek hace un descuento permanente del 75% en su modelo insignia de IA

DeepSeek ha anunciado que hará permanente un descuento del 75% en su modelo estrella de inteligencia artificial. La reducción de precio, introducida originalmente como una promoción temporal, se convierte ahora en una característica permanente para el acceso por API. Este movimiento reduce significativamente el costo para los desarrolladores que utilizan el modelo de primer nivel de DeepSeek.
Aunque el nombre exacto del modelo y los precios específicos no se detallaron en la fuente, el descuento se aplica a la oferta más avanzada de la compañía, probablemente DeepSeek-V2 o una versión similar. Para contexto, los modelos de DeepSeek son conocidos por su rendimiento competitivo en benchmarks como MMLU y tareas de codificación, a menudo rivalizando con GPT-4 y Claude 3 a una fracción del costo. Una reducción permanente del 75% convierte esto en una de las opciones más rentables para flujos de trabajo de codificación con agentes de IA, especialmente para usuarios de alto volumen.
Para los desarrolladores que dependen de agentes de codificación con IA, esto es una medida directa de ahorro de costos. Si ya usabas el modelo con la tarifa promocional, espera continuidad; si no, ahora es un buen momento para evaluar la API.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Anthropic restringe el uso de suscripciones a Claude con herramientas de terceros, incluyendo OpenClaw.
Anthropic anunció que a partir del 4 de abril a las 12 p. m. PT / 8 p. m. BST, los límites de suscripción de Claude ya no podrán utilizarse con herramientas de terceros como OpenClaw. Los usuarios deberán habilitar uso adicional con facturación por uso separada para estas integraciones.

Autoresearch impulsa a Qwen3.5-397B a 20.34 tok/s en M5 Max mediante transmisión SSD
Un desarrollador logró una velocidad de inferencia de 20.34 tokens/segundo para el modelo Qwen3.5-397B de 209GB en un MacBook Pro M5 Max con 128GB de RAM usando streaming SSD y 36 experimentos sistemáticos. El resultado representa una aceleración 2x sobre la línea base del M5 Max y 4.67x sobre el resultado original del M3 Max.

Claude UX de Colaboración Problema: La Caja de Entrada Persistente Crea Expectativas Falsas de Continuidad
Un usuario identifica un problema de experiencia de usuario en Claude Cowork donde el cuadro de entrada de texto persistente mantiene el texto borrador al cambiar entre tareas, pero restablece el contexto y pierde los archivos adjuntos, creando señales contradictorias sobre la continuidad.

OpenClaw pierde el acceso rentable a los modelos GPT y Claude.
Los usuarios de OpenClaw ya no pueden usar modelos de Anthropic sin pagar tarifas de API elevadas, y OpenAI ha reducido severamente las cuotas de cuentas Business y Teams a niveles casi equivalentes al plan gratuito, obligando a los usuarios a considerar alternativas chinas o modelos locales.