El modelo sigiloso Healer Alpha de OpenRouter parece ser una variante no lanzada de Qwen 3.5-Omni.

Especificaciones técnicas y evidencia
Healer Alpha se describe como que tiene "capacidades de visión, audición, razonamiento y acción" con percepción nativa de entradas visuales y de audio. El modelo acepta entradas de texto, imagen, audio y video y produce texto con una longitud máxima de salida de 65,536 tokens.
La ventana de contexto de 262,144 es un identificador clave: este número exacto (2^18) coincide precisamente con la longitud de contexto nativa de Qwen 3.5, no redondeada a 256K. Otros modelos usan longitudes diferentes: GPT-5.4 usa 272K, Gemini usa 1M, y Claude usa 200K-1M.
Conocimiento de arquitectura y capacidades
Cuando se le preguntó sobre las arquitecturas de Qwen, Healer Alpha produjo una explicación técnica de más de 2,000 palabras que cubría:
- Arquitectura Qwen3-Omni Thinker-Talker con división razonamiento/generación
- Fusión multimodal e integración del vocoder CosyVoice
- GDN (mecanismo de normalización con puerta) y enrutamiento de expertos MoE
- Manejo de contexto de 262K usando Ring Attention, optimización de caché KV, mosaico FlashAttention, escalado RoPE consciente de YaRN/NTK y aprendizaje curricular
En contraste, cuando se le preguntó sobre arquitecturas de DeepSeek o xAI, devolvió respuestas mínimas o nulas.
Competencia en idioma chino y metadatos de error
El modelo demostró composición de poesía china clásica a nivel nativo, escribiendo un 七言绝句 sobre IA con estructura tonal adecuada e imágenes clásicas. Incluso proporcionó análisis literario de su propio poema.
Durante un sondeo intenso, las respuestas de error revelaron metadatos: {"message": "Provider returned error", "code": 502, "metadata": {"provider_name": "Stealth"}}
Razonamiento de identificación del modelo
El análisis sugiere que esto podría ser una variante fusionada de "Qwen 3.5-Omni" que combina el contexto de 262K de Qwen 3.5 y la arquitectura híbrida GDN-MoE con las capacidades de audio/video de Qwen3-Omni. Esto representaría un nuevo modelo no lanzado, consistente con el patrón de OpenRouter de probar sigilosamente modelos no lanzados que necesitan datos del mundo real antes del lanzamiento.
El uso de "audición" en lugar de "audio" en la descripción coincide con el énfasis de Qwen3-Omni en la comprensión de voz/audio de extremo a extremo. El modelo se niega a identificarse en pruebas estructuradas de autoevaluación, manteniendo su naturaleza sigilosa.
📖 Leer la fuente completa: r/LocalLLaMA
👀 Ver también

Los ingenieros chinos de IA son los nuevos actores poderosos de Silicon Valley
Una periodista integrada en una casa compartida en Los Altos explora la comunidad de investigadores chinos de IA en Silicon Valley, describiendo paquetes de compensación de $200 millones, su intensa ética de trabajo y las fiestas en casa donde establecen contactos.
FairyFuse logra una aceleración del kernel de 29.6x en CPUs mediante inferencia sin multiplicación de pesos ternarios
FairyFuse fusiona ocho sub-GEMVs de valor real en un único bucle AVX-512 mediante sumas/restas enmascaradas, logrando 32.4 tokens/s en Xeon 8558P y una aceleración de 1.24x respecto a llama.cpp Q4_K_M con calidad casi sin pérdidas.

Claude Code v2.1.146: Comando /code-review, Corrección de paginación, Corrección de Windows PowerShell
Claude Code v2.1.146 renombra /simplify a /code-review con nivel de esfuerzo opcional, corrige paginación MCP y herramienta de Windows PowerShell, mejora la fiabilidad del actualizador automático y el rendimiento de renderizado de diferencias.

Repositorio de Habilidades de Bird Eliminado — Realiza una Copia de Seguridad de Tu Acceso a X/Twitter Ahora
La popular habilidad de pájaro de @steipete ha sido eliminada de GitHub. Los usuarios deben hacer una copia de seguridad de sus instalaciones de inmediato.