Hy3 LLM lidera rankings de OpenRouter: ¿El modelo más barato o algo más?

Un misterioso LLM llamado Hy3 preview se ha disparado al tope del ranking de modelos de IA de OpenRouter, superando a modelos establecidos como Claude Opus 4.7 y DeepSeek V4 Flash en más del 50% en uso de tokens. El modelo, una versión de código abierto de la megacorporación china Tencent, tiene un precio de $0.066/1M tokens de entrada en OpenRouter, lo que lo convierte en el modelo grande más barato de la plataforma, incluso más barato que DeepSeek V4 Flash a $0.10/1M tokens de entrada.
Sin embargo, la calidad del modelo no está a la altura de su popularidad. El repositorio de Hugging Face de Tencent muestra resultados de benchmark extrañamente honestos que no favorecen a Hy3 en comparación con otros modelos chinos de código abierto. Las pruebas del autor sugieren que la calidad del modelo está al nivel de otros modelos chinos, pero no se acerca a Claude Opus 4.7 o GPT 5.5.
Los datos de OpenRouter revelan varias peculiaridades:
- Pico de uso: Hy3 preview no tuvo uso antes del 8 de mayo de 2026, cuando pasó de un SKU gratuito a uno de pago. El uso ha sido constante desde entonces, lo que indica adopción orgánica.
- Uso mínimo en apps: Las 5 apps principales representan <1% de toda la actividad hacia Hy3. Esto descarta que una sola app haya cambiado su modelo predeterminado (como ocurrió antes con Grok Code Fast 1).
- 98% tokens de entrada, 2% de salida — una proporción extrema que sugiere un uso intensivo en tareas de recuperación o preprocesamiento, no en bucles de codificación agéntica.
- Único proveedor: Hy3 preview solo está disponible a través de SiliconFlow, un proveedor con sede en Singapur, que experimentó un enorme pico de uso coincidiendo con Hy3.
Cuando Hy3 pasó de gratuito a pago, el uso no disminuyó significativamente, lo que sugiere que los usuarios están dispuestos a pagar a pesar de la menor calidad del modelo, probablemente porque sigue siendo la opción más barata en OpenRouter. El autor pregunta: ¿es Hy3 preview realmente el LLM más barato respaldado por una gran empresa en OpenRouter?
Los desarrolladores que usan agentes de codificación de IA deben tener en cuenta que los ahorros de costos pueden venir a costa de la calidad. Si estás ejecutando inferencia de alto volumen donde la calidad del resultado es menos crítica (por ejemplo, extracción de datos, clasificación simple), Hy3 podría ser una opción viable. Pero para codificación agéntica compleja, espera resultados significativamente peores en comparación con Claude o GPT.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Usuario de Reddit informa 18.8 tok/s en inferencia por CPU con Qwen 3 30B Q4 en Zen 4.
Un usuario en r/LocalLLaMA probó Qwen 3 30B Q4 en CPU y logró 18.8 tokens por segundo con un procesador Zen 4 y memoria DDR5, superando significativamente las expectativas de 3-5 tok/s.

Claude Code v2.1.162 incluye información de espera de sesión, corrección de tiempo de espera de MCP y renovación de la vista de Agentes
Claude Code v2.1.162 añade `waitingFor` a la salida `--json`, corrige el error de timeout de MCP por debajo de 1000ms, mejora el renderizado del terminal para la vista de agentes y más. Detalles dentro.

Estudio de Stanford: Profesores de Derecho Prefieren Respuestas de IA sobre las de sus Colegas el 75% del Tiempo
En una evaluación ciega de casi 3,000 comparaciones, los profesores de derecho calificaron significativamente mejor las respuestas generadas por IA que las escritas por colegas. Las respuestas de IA fueron señaladas como dañinas solo el 3.5% del tiempo, frente al 12% de las humanas.

Anthropic asegura 300MW de cómputo en Colossus 1 con 220,000 GPU NVIDIA mediante asociación con SpaceX
Anthropic anunció una asociación con SpaceX para utilizar toda la capacidad de cómputo en el centro de datos Colossus 1, obteniendo más de 300MW y más de 220,000 GPU NVIDIA en un mes.