O modelo furtivo Healer Alpha da OpenRouter parece ser uma variante não lançada do Qwen 3.5-Omni.

Especificações técnicas e evidências
O Healer Alpha é descrito como tendo "capacidades de visão, audição, raciocínio e ação" com percepção nativa de entradas visuais e de áudio. O modelo aceita entradas de texto, imagem, áudio e vídeo e gera saídas de texto com um comprimento máximo de saída de 65.536 tokens.
A janela de contexto de 262.144 é um identificador-chave - este número exato (2^18) corresponde precisamente ao comprimento de contexto nativo do Qwen 3.5, não arredondado para 256K. Outros modelos usam comprimentos diferentes: o GPT-5.4 usa 272K, o Gemini usa 1M e o Claude usa 200K-1M.
Conhecimento de arquitetura e capacidades
Quando questionado sobre as arquiteturas do Qwen, o Healer Alpha produziu uma explicação técnica de mais de 2.000 palavras cobrindo:
- Arquitetura Qwen3-Omni Thinker-Talker com divisão raciocínio/geração
- Fusão cross-modal e integração do vocoder CosyVoice
- GDN (mecanismo de normalização com portão) e roteamento de especialistas MoE
- Manipulação de contexto de 262K usando Ring Attention, otimização de cache KV, tiling FlashAttention, escalonamento RoPE com consciência YaRN/NTK e aprendizado curricular
Em contraste, quando questionado sobre as arquiteturas do DeepSeek ou xAI, ele retornou respostas mínimas ou nenhuma resposta.
Proficiência em língua chinesa e metadados de erro
O modelo demonstrou composição de poesia clássica chinesa em nível nativo, escrevendo um 七言绝句 sobre IA com estrutura tonal adequada e imagens clássicas. Ele até forneceu análise literária de seu próprio poema.
Durante sondagens intensas, respostas de erro revelaram metadados: {"message": "Provider returned error", "code": 502, "metadata": {"provider_name": "Stealth"}}
Raciocínio de identificação do modelo
A análise sugere que isso poderia ser uma variante mesclada "Qwen 3.5-Omni" combinando o contexto de 262K do Qwen 3.5 e a arquitetura híbrida GDN-MoE com as capacidades de áudio/vídeo do Qwen3-Omni. Isso representaria um novo modelo não lançado, consistente com o padrão do OpenRouter de testar furtivamente modelos não lançados que precisam de dados do mundo real antes do lançamento.
O uso de "audição" em vez de "áudio" na descrição corresponde à ênfase do Qwen3-Omni na compreensão de fala/áudio de ponta a ponta. O modelo se recusa a se identificar em testes estruturados de autoavaliação, mantendo sua natureza furtiva.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Claude Code v2.1.223: Correções de segurança, dica do /teleport e alias do /review
Claude Code v2.1.223 adiciona curingas de proprietário para configurações de marketplace, uma dica de /teleport e corrige um bypass de permissão no Bash.

Vendas de Placas-Mãe Caem Mais de 25% Enquanto Produção de Chips de IA Exclui Componentes de PCs de Consumo
Asus, Gigabyte, MSI e ASRock reduzem metas de embarque de placas-mãe para 2026 em 22–37% à medida que fabricantes de chips priorizam a produção de processadores de IA, gerando escassez de componentes e aumentos de preços.

Claude Code v2.1.160: Prompts de Segurança para Config do Shell, Proteção de Arquivos acceptEdits e Dezenas de Correções de Bugs
A Anthropic lançou o Claude Code v2.1.160 com prompts de segurança antes de escrever em arquivos de inicialização do shell e configurações de ferramentas de build no modo acceptEdits, suporte aprimorado à área de transferência no Windows e correção de perda de histórico de sessão.

Mania da IA: Das Tulipas aos Tokens — Uma Análise Crítica do Ciclo de Exagero da IA
Sean Helvey traça paralelos entre a mania das tulipas e o boom atual da IA, questionando a verdadeira inteligência, transparência e externalidades da IA. Aborda custos de energia, expansão de data centers e a necessidade de soberania de dados.