Análisis de Precios de Modelos de OpenRouter e Inteligencia por Dólar

Comparación de Inteligencia y Precios de Modelos
Un desarrollador analizó los precios de la API de OpenRouter para 16 modelos de IA y calculó los valores de inteligencia por dólar para ayudar a seleccionar modelos para tareas específicas. La métrica de inteligencia combina siete puntos de referencia: Índice de Inteligencia de Análisis Artificial, Índice Agéntico, Índice de Codificación, Índice de Omnisciencia de Análisis Artificial (reescalado a 0-100), GPDval-AA, Terminal-Bench Hard y t2-Bench Telecom.
Hallazgos Clave
El análisis identificó varios modelos destacados:
- Mayor inteligencia: GPT-5.4 (58.8 de inteligencia, $2.50/M de tokens) y Gemini 3.1 Pro (58.6 de inteligencia, $2.00/M de tokens)
- Mejor valor: MiMo-V2-Flash (39.9 de inteligencia, $0.09/M de tokens, puntuación de valor 443)
- Modelos equilibrados: GLM-5, Kimi K2.5 y Gemini 3 Flash
Detalles y Capacidades de los Modelos
El conjunto de datos completo incluye:
- MiMo-V2-Flash: 39.9 de inteligencia, $0.09/M de tokens, valor 443, solo texto
- Step 3.5 Flash: 34.8 de inteligencia, $0.10/M de tokens, valor 348, tareas de texto rápido general
- Grok 4.1 Fast: 41.2 de inteligencia, $0.20/M de tokens, valor 205, ventana de contexto de 2M, enrutamiento y extracción de alta velocidad
- MiniMax M2.5: 40.3 de inteligencia, $0.27/M de tokens, valor 149, código abierto, excelente rendimiento en tareas de codificación real
- DeepSeek V3.2: 34.6 de inteligencia, $0.25/M de tokens, valor 138, fuertes capacidades de codificación y lógica, admite aciertos de caché de API
- Kimi K2.5: 45.8 de inteligencia, $0.45/M de tokens, valor 101, ventana de contexto de 262K, amplio conocimiento general
- Gemini 3 Flash: 47.7 de inteligencia, $0.50/M de tokens, valor 95, multimodal con soporte de entrada de audio
- GLM-4.7: 31.6 de inteligencia, $0.38/M de tokens, valor 83, generación de texto general
- Qwen 3.5: 41.1 de inteligencia, $0.60/M de tokens, valor 68, fuerte rendimiento general, propósito general
- GLM-5: 49.5 de inteligencia, $0.80/M de tokens, valor 61, ventana de contexto de 200K, conocimiento general
- Claude Haiku 4.5: 36.5 de inteligencia, $1.00/M de tokens, valor 36, rápido y económico, soporte de pensamiento extendido
- GPT-5.3: 55.9 de inteligencia, $1.75/M de tokens, valor 32, razonamiento general y procesamiento de texto
- GPT-5.2: 50.8 de inteligencia, $1.75/M de tokens, valor 29, excelente para tareas de codificación + agénticas
- Gemini 3.1 Pro: 58.6 de inteligencia, $2.00/M de tokens, valor 29, análisis multimodal, soporte de salida de imagen
- Grok 4.2 Beta: 49.6 de inteligencia, $2.00/M de tokens, valor 25, razonamiento pesado, amplia base de conocimientos
- GPT-5.4: 58.8 de inteligencia, $2.50/M de tokens, valor 24, niveles de contexto variables (<272K / >272K), razonamiento de primer nivel
- Claude Sonnet 4.6: 52.3 de inteligencia, $3.00/M de tokens, valor 17, modelo de trabajo, entrenado hasta enero de 2026
- Claude Opus 4.6: 51.9 de inteligencia, $5.00/M de tokens, valor 10, razonamiento de primer nivel, más fuerte para codificación e ingeniería de software
Observaciones Notables
El análisis señala que los modelos más inteligentes suelen tener peores puntuaciones de valor, pero esto puede no reflejar la eficiencia real. Por ejemplo, si Qwen 3.5 usa 500,000 tokens y 30 minutos para resolver un problema incorrectamente mientras que Sonnet lo resuelve correctamente en una décima parte del tiempo, Sonnet podría ser mejor valor a pesar de su puntuación más baja de inteligencia por dólar.
La ventana de contexto de 2M de Grok 4.1 le da un impulso de inteligencia que no aparecerá en la mayoría de los casos de uso. MiniMax 2.5 lo supera en todas las métricas excepto en la ventana de contexto.
GLM-5 marca el último modelo antes de una caída significativa en el valor (de 61 a 36 con Claude Haiku 4.5) y, según se informa, es casi tan inteligente como GPT-5.2.
📖 Read the full source: r/openclaw
👀 Ver también

Habilidad de Aventura de Texto Claude v1.1.0 Agrega Arcos de Campaña y NPCs Mejorados
La actualización de habilidad de aventura de texto Claude v1.1.0 introduce arcos de campaña donde la progresión del personaje persiste entre aventuras, PNJ con estadísticas y niveles ocultos, y módulos visuales/auditivos opcionales. Descarga text-adventure.zip desde los lanzamientos de GitHub para usar con Claude Desktop o claude.ai.

Steerling-8B: Un modelo de lenguaje interpretable con atribución a nivel de token
Guide Labs lanzó Steerling-8B, un modelo de lenguaje de 8 mil millones de parámetros entrenado en 1.35 billones de tokens que puede rastrear cualquier token generado hasta el contexto de entrada, conceptos comprensibles para humanos y fuentes de datos de entrenamiento. El modelo logra un rendimiento competitivo con modelos entrenados con 2-7× más datos.

Complemento de Canal Personalizado de WhatsApp para Claude Code Usando Baileys
Un desarrollador creó un complemento de canal personalizado que agrega soporte de WhatsApp a Claude Code 2.1.80+ usando Baileys v7, implementando el protocolo WhatsApp Web Multi-Device como un servidor MCP con la capacidad experimental claude/channel.

Biblioteca de Prompts para Agentes de IA de Código Abierto Alcanza las 100 Estrellas en GitHub
Un repositorio comunitario llamado ai-setup proporciona prompts de sistema compartidos, reglas de Cursor, configuraciones de Claude y configuraciones de flujo de trabajo de modelos locales para agentes de IA. El proyecto tiene 100 estrellas en GitHub y 90 PR fusionados.