Hy3 LLM en tête des classements OpenRouter : Le modèle le moins cher ou autre chose ?

Un LLM mystérieux appelé Hy3 preview a grimpé en tête du classement des modèles d'IA d'OpenRouter, battant des modèles établis comme Claude Opus 4.7 et DeepSeek V4 Flash de plus de 50 % en utilisation de tokens. Ce modèle, une version open source du géant chinois Tencent, est proposé à 0,066 $/1M tokens d'entrée sur OpenRouter, ce qui en fait le modèle majeur le moins cher de la plateforme — encore moins cher que DeepSeek V4 Flash à 0,10 $/1M tokens d'entrée.
Cependant, la qualité du modèle ne correspond pas à sa popularité. Le référentiel Hugging Face de Tencent montre des résultats de benchmark étrangement honnêtes qui ne sont pas favorables à Hy3 par rapport à d'autres modèles open source chinois. Des tests effectués par l'auteur suggèrent que la qualité du modèle est comparable à celle d'autres modèles chinois, mais loin du niveau de Claude Opus 4.7 ou GPT 5.5.
Les données d'OpenRouter révèlent plusieurs particularités :
- Pic d'utilisation : Hy3 preview n'avait aucune utilisation avant le 8 mai 2026, date à laquelle il est passé d'une SKU gratuite à payante. L'utilisation est stable depuis, ce qui indique une adoption organique.
- Utilisation applicative minimale : Les 5 principales applications représentent <1 % de toute l'activité de Hy3. Cela exclut qu'une seule application ait changé de modèle par défaut (comme ce fut le cas avec Grok Code Fast 1 auparavant).
- 98 % de tokens d'entrée, 2 % de sortie — un ratio extrême suggérant une utilisation intensive dans des tâches de récupération ou de prétraitement, et non des boucles de codage agentique.
- Fournisseur unique : Hy3 preview n'est disponible que via SiliconFlow, un fournisseur basé à Singapour, qui a connu un pic d'utilisation massif coïncidant avec Hy3.
Lorsque Hy3 est passé de gratuit à payant, l'utilisation n'a pas chuté de façon significative, ce qui suggère que les utilisateurs sont prêts à payer malgré la qualité inférieure du modèle — probablement parce qu'il reste l'option la moins chère sur OpenRouter. L'auteur se demande : Hy3 preview est-il vraiment le LLM le moins cher soutenu par une grande entreprise sur OpenRouter ?
Les développeurs utilisant des agents de codage IA doivent être conscients que les économies de coûts peuvent se faire au détriment de la qualité. Si vous effectuez des inférences à volume élevé où la qualité de sortie est moins critique (par exemple, extraction de données, classification simple), Hy3 pourrait être une option viable. Mais pour le codage agentique complexe, attendez-vous à des résultats nettement moins bons qu'avec Claude ou GPT.
📖 Lire la source complète : HN AI Agents
👀 See Also
Claude AI ouvre une PR fusionnée pour un bug de lien magique pendant que le développeur dort
Un utilisateur de Reddit rapporte que Claude AI a automatiquement corrigé un bug de production de lien magique à 4h46 du matin — l'étape trim/lowercase a été déplacée avant la regex de validation d'email — la PR a été fusionnée sans modifications.

Des chercheurs de l'Université de Washington prévoient d'utiliser des caméras portées par les enseignants pour la formation en IA, les parents peuvent s'y opposer
Des chercheurs de l'Université de Washington prévoyaient que des enseignants de maternelle portent des caméras subjectives pour enregistrer les enfants, afin d'entraîner des modèles d'IA, avec un modèle de consentement implicite.

Préoccupations concernant la visibilité des coûts de l'API Claude pour les développeurs indépendants
Une discussion sur Reddit souligne que l'absence de suivi granulaire des coûts de l'API Claude Sonnet pourrait pousser les développeurs indépendants à l'abandonner malgré sa qualité, avec des factures de 400 à 900 dollars les prenant au dépourvu en raison d'une observabilité insuffisante comparée au monitoring de type AWS.

GLM-5.1 sorti avec des performances de codage équivalentes à Claude Opus 4.5
Le modèle GLM-5.1 de Zhipu AI est désormais disponible pour tous les utilisateurs du Coding Plan, obtenant 77,8 points sur SWE-bench-Verified et 56,2 points sur Terminal Bench 2.0. Le modèle dispose d'une fenêtre de contexte de 200K, d'une sortie maximale de 128K et de 744B paramètres avec 40B activés.