Hy3 LLM lidera classificações do OpenRouter: modelo mais barato ou algo mais?

Um misterioso LLM chamado Hy3 preview disparou para o topo do ranking de modelos de IA do OpenRouter, superando modelos consagrados como Claude Opus 4.7 e DeepSeek V4 Flash em mais de 50% no uso de tokens. O modelo, uma versão open-source da gigante chinesa Tencent, está disponível no OpenRouter por $0,066/1M tokens de entrada, tornando-se o modelo grande mais barato da plataforma — ainda mais barato que o DeepSeek V4 Flash, que custa $0,10/1M tokens de entrada.
No entanto, a qualidade do modelo não acompanha sua popularidade. O repositório da Tencent no Hugging Face mostra resultados de benchmark surpreendentemente honestos que não são favoráveis ao Hy3 em comparação com outros modelos open-source chineses. Testes realizados pelo autor sugerem que a qualidade do modelo está no mesmo nível de outros modelos chineses, mas não se aproxima do Claude Opus 4.7 ou GPT 5.5.
Os dados do OpenRouter revelam várias peculiaridades:
- Pico de uso: Hy3 preview não tinha uso antes de 8 de maio de 2026, quando passou de um SKU gratuito para pago. Desde então, o uso tem sido constante, indicando adoção orgânica.
- Uso mínimo por aplicativos: Os 5 principais aplicativos respondem por <1% de toda a atividade do Hy3. Isso descarta a possibilidade de um único aplicativo ter trocado o modelo padrão (como aconteceu com Grok Code Fast 1 anteriormente).
- 98% tokens de entrada, 2% de saída — uma proporção extrema que sugere uso intenso em tarefas de recuperação ou pré-processamento, e não em loops de codificação agentivos.
- Único provedor: Hy3 preview está disponível apenas via SiliconFlow, um provedor sediado em Singapura, que viu um pico massivo de uso coincidindo com o Hy3.
Quando o Hy3 passou de gratuito para pago, o uso não caiu significativamente, sugerindo que os usuários estão dispostos a pagar apesar da qualidade inferior do modelo — provavelmente porque continua sendo a opção mais barata no OpenRouter. O autor pergunta: o Hy3 preview é realmente o LLM mais barato apoiado por uma grande empresa no OpenRouter?
Desenvolvedores que usam agentes de codificação com IA devem estar cientes de que a economia de custos pode vir com uma perda de qualidade. Se você está executando inferência em alto volume onde a qualidade da saída é menos crítica (por exemplo, extração de dados, classificação simples), o Hy3 pode ser uma opção viável. Mas para codificação agentiva complexa, espere resultados significativamente piores em comparação com Claude ou GPT.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Relato de Interrupção Parcial do Claude Code na Web
Uma atualização automática de status do r/ClaudeAI relata uma interrupção parcial no Claude Code na web a partir de 2026-05-09T23:33:21.000Z. Consulte a página de status oficial e o megathread da comunidade para atualizações.

Verificação do Chip Claude da Samsung: Problemas Reais com IA no Design de Semicondutores
A Samsung está usando o Claude da Anthropic para verificar projetos de chips, mas o processo não está indo bem. Veja o que sabemos.

Erros Elevados no Claude Opus 4.7: Atualização de Status e O que Esperar
Claude Opus 4.7 está apresentando erros elevados desde 2026-05-19T15:21Z. Verifique status.claude.com para progresso e resoluções.

O Uso de Água pela IA Não é um Problema: Análise nos Níveis Nacional, Local e Pessoal
Andy Masley analisa os números do consumo de água em data centers de IA em comparação com outras indústrias e conclui que é um 'falso problema' — a receita fiscal por galão é alta, e o uso por pessoa é insignificante.