Hy3 LLM en tête des classements OpenRouter : Le modèle le moins cher ou autre chose ?

Un LLM mystérieux appelé Hy3 preview a grimpé en tête du classement des modèles d'IA d'OpenRouter, battant des modèles établis comme Claude Opus 4.7 et DeepSeek V4 Flash de plus de 50 % en utilisation de tokens. Ce modèle, une version open source du géant chinois Tencent, est proposé à 0,066 $/1M tokens d'entrée sur OpenRouter, ce qui en fait le modèle majeur le moins cher de la plateforme — encore moins cher que DeepSeek V4 Flash à 0,10 $/1M tokens d'entrée.
Cependant, la qualité du modèle ne correspond pas à sa popularité. Le référentiel Hugging Face de Tencent montre des résultats de benchmark étrangement honnêtes qui ne sont pas favorables à Hy3 par rapport à d'autres modèles open source chinois. Des tests effectués par l'auteur suggèrent que la qualité du modèle est comparable à celle d'autres modèles chinois, mais loin du niveau de Claude Opus 4.7 ou GPT 5.5.
Les données d'OpenRouter révèlent plusieurs particularités :
- Pic d'utilisation : Hy3 preview n'avait aucune utilisation avant le 8 mai 2026, date à laquelle il est passé d'une SKU gratuite à payante. L'utilisation est stable depuis, ce qui indique une adoption organique.
- Utilisation applicative minimale : Les 5 principales applications représentent <1 % de toute l'activité de Hy3. Cela exclut qu'une seule application ait changé de modèle par défaut (comme ce fut le cas avec Grok Code Fast 1 auparavant).
- 98 % de tokens d'entrée, 2 % de sortie — un ratio extrême suggérant une utilisation intensive dans des tâches de récupération ou de prétraitement, et non des boucles de codage agentique.
- Fournisseur unique : Hy3 preview n'est disponible que via SiliconFlow, un fournisseur basé à Singapour, qui a connu un pic d'utilisation massif coïncidant avec Hy3.
Lorsque Hy3 est passé de gratuit à payant, l'utilisation n'a pas chuté de façon significative, ce qui suggère que les utilisateurs sont prêts à payer malgré la qualité inférieure du modèle — probablement parce qu'il reste l'option la moins chère sur OpenRouter. L'auteur se demande : Hy3 preview est-il vraiment le LLM le moins cher soutenu par une grande entreprise sur OpenRouter ?
Les développeurs utilisant des agents de codage IA doivent être conscients que les économies de coûts peuvent se faire au détriment de la qualité. Si vous effectuez des inférences à volume élevé où la qualité de sortie est moins critique (par exemple, extraction de données, classification simple), Hy3 pourrait être une option viable. Mais pour le codage agentique complexe, attendez-vous à des résultats nettement moins bons qu'avec Claude ou GPT.
📖 Lire la source complète : HN AI Agents
👀 See Also

Claude contre GPT-4o : Même consigne pour double pendule, conventions de coordonnées différentes
Claude et GPT-4o produisent des simulations de double pendule visuellement différentes car ils interprètent thêta à partir de verticales opposées — haut contre bas — tout en utilisant le même moteur de rendu. Les calculs sont corrects dans les deux cas, mais le décalage révèle une ambiguïté subtile dans l'interprétation du prompt.

Qwen3.5-27B : Comparaison des performances en 8 bits et 16 bits
Un utilisateur de Reddit a testé Qwen3.5-27B avec vLLM en comparant les poids bf16 et le cache KV 16 bits contre la quantification fp8 de Qwen avec un cache KV 8 bits, constatant des résultats pratiquement identiques sur le benchmark Aider en utilisant une RTX 6000 Pro.

Claude Code ajoute un mode vocal pour les commandes de codage mains libres.
Anthropic déploie le mode vocal pour Claude Code, son assistant d'IA pour le codage, permettant aux développeurs d'interagir via des commandes vocales. La fonctionnalité est actuellement disponible pour environ 5 % des utilisateurs, avec une disponibilité plus large prévue dans les prochaines semaines.

Claude-Code v2.1.92 ajoute un assistant de configuration Bedrock, des décompositions de coûts et plusieurs correctifs.
Claude-Code v2.1.92 introduit un assistant interactif de configuration AWS Bedrock, des ventilations de coûts par modèle pour les abonnés, et des correctifs pour le lancement de sous-agents, les crochets d'invite et les problèmes d'affichage du terminal. La version supprime également les commandes /tag et /vim.