Hy3 LLM lidera classificações do OpenRouter: modelo mais barato ou algo mais?

Um misterioso LLM chamado Hy3 preview disparou para o topo do ranking de modelos de IA do OpenRouter, superando modelos consagrados como Claude Opus 4.7 e DeepSeek V4 Flash em mais de 50% no uso de tokens. O modelo, uma versão open-source da gigante chinesa Tencent, está disponível no OpenRouter por $0,066/1M tokens de entrada, tornando-se o modelo grande mais barato da plataforma — ainda mais barato que o DeepSeek V4 Flash, que custa $0,10/1M tokens de entrada.
No entanto, a qualidade do modelo não acompanha sua popularidade. O repositório da Tencent no Hugging Face mostra resultados de benchmark surpreendentemente honestos que não são favoráveis ao Hy3 em comparação com outros modelos open-source chineses. Testes realizados pelo autor sugerem que a qualidade do modelo está no mesmo nível de outros modelos chineses, mas não se aproxima do Claude Opus 4.7 ou GPT 5.5.
Os dados do OpenRouter revelam várias peculiaridades:
- Pico de uso: Hy3 preview não tinha uso antes de 8 de maio de 2026, quando passou de um SKU gratuito para pago. Desde então, o uso tem sido constante, indicando adoção orgânica.
- Uso mínimo por aplicativos: Os 5 principais aplicativos respondem por <1% de toda a atividade do Hy3. Isso descarta a possibilidade de um único aplicativo ter trocado o modelo padrão (como aconteceu com Grok Code Fast 1 anteriormente).
- 98% tokens de entrada, 2% de saída — uma proporção extrema que sugere uso intenso em tarefas de recuperação ou pré-processamento, e não em loops de codificação agentivos.
- Único provedor: Hy3 preview está disponível apenas via SiliconFlow, um provedor sediado em Singapura, que viu um pico massivo de uso coincidindo com o Hy3.
Quando o Hy3 passou de gratuito para pago, o uso não caiu significativamente, sugerindo que os usuários estão dispostos a pagar apesar da qualidade inferior do modelo — provavelmente porque continua sendo a opção mais barata no OpenRouter. O autor pergunta: o Hy3 preview é realmente o LLM mais barato apoiado por uma grande empresa no OpenRouter?
Desenvolvedores que usam agentes de codificação com IA devem estar cientes de que a economia de custos pode vir com uma perda de qualidade. Se você está executando inferência em alto volume onde a qualidade da saída é menos crítica (por exemplo, extração de dados, classificação simples), o Hy3 pode ser uma opção viável. Mas para codificação agentiva complexa, espere resultados significativamente piores em comparação com Claude ou GPT.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Análise de 100 milhões de tokens no Claude Code revela 99,4% de uso de entrada.
Análise de 1.289 solicitações em sessões de codificação estendidas mostra que o Claude Code usou 100,3M tokens de entrada (99,4%) versus apenas 616K tokens de saída (0,6%), com 84,2M tokens armazenados em cache devido ao reenvio repetido de contexto.

Claude Code Opus Falha com Erro de Limite de Taxa Apesar da Capacidade Semanal Disponível
Um assinante do Claude Max relata que o Claude Code Opus retorna 'Erro de API: Limite de taxa atingido' mesmo que seu painel de uso mostre que 97% da capacidade semanal de 'Todos os modelos' permanece não utilizada. O problema ocorre especificamente no Claude Code, enquanto o Opus funciona normalmente no claude.ai na mesma conta.

Domo CDO: Pare o FOMO de IA, Comece com Planilhas
O diretor de design da Domo, Chris Willis, argumenta que a IA está sendo vendida sem especificações, criando um teatro de 'tokenmaxxing' baseado no medo. Sua solução: comece automatizando um processo de planilha, não perseguindo metas mirabolantes.

Agent.Email: Agentes de IA se inscrevem via curl, Reivindicados por OTP Humano
AgentMail's Agent.Email permite que agentes de IA provisionem automaticamente uma caixa de entrada via curl, que depois é reivindicada por um humano com um OTP. Acesso restrito até ser reivindicado, com limite de taxa por IP.