O modelo furtivo Healer Alpha da OpenRouter parece ser uma variante não lançada do Qwen 3.5-Omni.

✍️ OpenClawRadar📅 Publicado: March 12, 2026🔗 Source
O modelo furtivo Healer Alpha da OpenRouter parece ser uma variante não lançada do Qwen 3.5-Omni.
Ad

Especificações técnicas e evidências

O Healer Alpha é descrito como tendo "capacidades de visão, audição, raciocínio e ação" com percepção nativa de entradas visuais e de áudio. O modelo aceita entradas de texto, imagem, áudio e vídeo e gera saídas de texto com um comprimento máximo de saída de 65.536 tokens.

A janela de contexto de 262.144 é um identificador-chave - este número exato (2^18) corresponde precisamente ao comprimento de contexto nativo do Qwen 3.5, não arredondado para 256K. Outros modelos usam comprimentos diferentes: o GPT-5.4 usa 272K, o Gemini usa 1M e o Claude usa 200K-1M.

Conhecimento de arquitetura e capacidades

Quando questionado sobre as arquiteturas do Qwen, o Healer Alpha produziu uma explicação técnica de mais de 2.000 palavras cobrindo:

  • Arquitetura Qwen3-Omni Thinker-Talker com divisão raciocínio/geração
  • Fusão cross-modal e integração do vocoder CosyVoice
  • GDN (mecanismo de normalização com portão) e roteamento de especialistas MoE
  • Manipulação de contexto de 262K usando Ring Attention, otimização de cache KV, tiling FlashAttention, escalonamento RoPE com consciência YaRN/NTK e aprendizado curricular

Em contraste, quando questionado sobre as arquiteturas do DeepSeek ou xAI, ele retornou respostas mínimas ou nenhuma resposta.

Ad

Proficiência em língua chinesa e metadados de erro

O modelo demonstrou composição de poesia clássica chinesa em nível nativo, escrevendo um 七言绝句 sobre IA com estrutura tonal adequada e imagens clássicas. Ele até forneceu análise literária de seu próprio poema.

Durante sondagens intensas, respostas de erro revelaram metadados: {"message": "Provider returned error", "code": 502, "metadata": {"provider_name": "Stealth"}}

Raciocínio de identificação do modelo

A análise sugere que isso poderia ser uma variante mesclada "Qwen 3.5-Omni" combinando o contexto de 262K do Qwen 3.5 e a arquitetura híbrida GDN-MoE com as capacidades de áudio/vídeo do Qwen3-Omni. Isso representaria um novo modelo não lançado, consistente com o padrão do OpenRouter de testar furtivamente modelos não lançados que precisam de dados do mundo real antes do lançamento.

O uso de "audição" em vez de "áudio" na descrição corresponde à ênfase do Qwen3-Omni na compreensão de fala/áudio de ponta a ponta. O modelo se recusa a se identificar em testes estruturados de autoavaliação, mantendo sua natureza furtiva.

📖 Leia a fonte completa: r/LocalLLaMA

Ad

👀 See Also

Ferramentas de IA Aumentam a Carga de Trabalho em Engenharia e Transformam Funções Profissionais
News

Ferramentas de IA Aumentam a Carga de Trabalho em Engenharia e Transformam Funções Profissionais

Um estudo da Harvard Business Review de fevereiro de 2026 descobriu que 83% dos trabalhadores relataram aumento na carga de trabalho devido a ferramentas de IA, com 62% experimentando esgotamento. O artigo descreve como a IA mudou os papéis da engenharia de escrever código para revisar código gerado por IA.

OpenClawRadar
Uso de água em centros de dados de IA na Califórnia: Estimativas a partir de modelos físicos e de IA
News

Uso de água em centros de dados de IA na Califórnia: Estimativas a partir de modelos físicos e de IA

Uma análise da California WaterBlog usando física e quatro modelos de IA estima o uso de água por data centers de IA na Califórnia em 2.300–400.000 acre-pés/ano, com uma faixa realista de 32.000–290.000 acre-pés/ano — modesta em comparação com a agricultura.

OpenClawRadar
Encíclica do Papa Leão XIV sobre IA: Principais Pontos para Desenvolvedores
News

Encíclica do Papa Leão XIV sobre IA: Principais Pontos para Desenvolvedores

O Vaticano publicou uma encíclica sobre ética em IA. O documento destaca problemas de interpretabilidade de LLMs, vieses culturais nos dados de treinamento e o custo ambiental da IA.

OpenClawRadar
Lançamento do Claude Code v2.1.117: Divisão de Subagentes, Melhorias em Plugins e Correções de Desempenho
News

Lançamento do Claude Code v2.1.117: Divisão de Subagentes, Melhorias em Plugins e Correções de Desempenho

O Claude Code v2.1.117 permite subagentes bifurcados em builds externos via CLAUDE_CODE_FORK_SUBAGENT=1, melhora o gerenciamento de dependências de plugins e corrige os cálculos da janela de contexto do Opus 4.7. A versão inclui inicialização mais rápida com conexões MCP simultâneas e substitui as ferramentas Glob/Grep por bfs/ugrep embutidos no macOS/Linux.

OpenClawRadar