Comparación Actual de Costos de LLM: Deepseek, Qwen, MiniMax vs OpenAI

Desglose de Precios por Proveedor
Aquí está la comparación de costos actual entre los principales proveedores de LLM según un análisis reciente de Reddit. Todos los precios están en USD por 1 millón de tokens y se obtuvieron a partir de la fecha del análisis.
- Deepseek-V3.2: $0.26 entrada / $0.38 salida. Esto es aproximadamente 10 veces más económico que GPT-4, mientras ofrece lo que los puntos de referencia sugieren que es un rendimiento de clase GPT-5.
- Serie Qwen3.5: El modelo 27B cuesta $0.26 entrada / $2.60 salida, ofreciendo una calidad comparable a Claude a una fracción del costo. La serie proporciona flexibilidad que abarca desde 0.8B hasta 397TB de parámetros, con cada variante admitiendo ventanas de contexto de 262k ampliables a 1M+ y un modo de pensamiento incorporado.
- MiniMax-M2.5: $0.27 entrada / $0.95 salida. Destaca en flujos de trabajo de codificación con un 80.2% en SWE bench verificado, lo que lo hace excepcional para tareas de codificación agentica.
- OpenAI GPT-4.1: $2.00 entrada / $8.00 salida. Aunque ciertamente es capaz, la prima de precio es difícil de justificar para casos de uso de producción de alto volumen cuando las alternativas funcionan de manera comparable.
Contexto Técnico Clave
El análisis incluye puntajes LMSYS ELO cuando están disponibles, ya que la mayoría de los otros puntos de referencia parecen estar optimizados en este momento. La capacidad de la ventana de contexto se ha vuelto cada vez más importante, con la mayoría de los modelos actuales admitiendo 200k+ tokens como estándar, lo que cambia fundamentalmente cómo puedes estructurar aplicaciones en torno a documentos largos y conversaciones extendidas.
Para desarrolladores que utilizan agentes de codificación con IA, estas disparidades de precios son significativas al considerar los costos de implementación en producción. Los datos sugieren que las alternativas a modelos de precio premium como GPT-4 pueden ofrecer un rendimiento comparable a costos sustancialmente más bajos, particularmente para casos de uso de alto volumen.
📖 Read the full source: r/LocalLLaMA
👀 Ver también

Qwen3.6 Plus Preview Disponible Gratis a Través de OpenRouter para OpenClaw
El modelo Qwen3.6 Plus Preview ahora está accesible sin costo a través de OpenRouter para usuarios de OpenClaw. La configuración requiere obtener claves API de OpenRouter y configurarlas en OpenClaw, con un aviso para establecer el nivel de pensamiento durante el uso inicial.

Anthropic limita OpenClaw con nuevo sistema de crédito: Detalles e impacto
Anthropic vuelve a limitar OpenClaw: a partir del 15 de junio de 2026, todo el uso programático pasa a un grupo de créditos separado con topes mensuales, sin acumulación, y facturación por exceso a tarifas de API.

Error de facturación en el diseño de Claude: La compra de uso adicional no se aplica, el bot de soporte atrapa a los usuarios de pago
Un usuario de Claude Design pagó $20 por uso adicional a través del flujo de compra dentro de la aplicación, pero los créditos no se aplican al límite de uso separado de Claude Design. El bot de soporte Fin malinterpreta el problema, entra en un bucle de respuestas irrelevantes y bloquea nuevos tickets sin posibilidad de escalar a un humano.

El Pentágono establece el viernes como fecha límite para que Anthropic abandone las normas de ética en IA.
El Pentágono le ha dado a Anthropic hasta el viernes para que abandone sus normas de ética en IA, según un informe de Politico. El artículo recibió 15 puntos y 3 comentarios en Hacker News.