Стелс-модель Healer Alpha от OpenRouter, по-видимому, является невыпущенным вариантом Qwen 3.5-Omni.

Технические характеристики и доказательства
Healer Alpha описывается как модель с "возможностями зрения, слуха, рассуждения и действия", обладающая естественным восприятием визуальных и аудиовходов. Модель принимает текстовые, графические, аудио- и видеовходы и выводит текст с максимальной длиной вывода 65 536 токенов.
Контекстное окно в 262 144 токена является ключевым идентификатором — это точное число (2^18) в точности соответствует нативной длине контекста Qwen 3.5, а не округлённое до 256K. Другие модели используют иные длины: GPT-5.4 использует 272K, Gemini — 1M, а Claude — 200K-1M.
Знание архитектуры и возможности
Когда Healer Alpha спросили об архитектурах Qwen, она предоставила техническое объяснение объёмом более 2000 слов, охватывающее:
- Архитектуру Qwen3-Omni Thinker-Talker с разделением на рассуждение и генерацию
- Кросс-модальное слияние и интеграцию вокодера CosyVoice
- GDN (механизм гейтированной нормализации) и маршрутизацию экспертов MoE
- Обработку контекста в 262K с использованием Ring Attention, оптимизации KV-кэша, тайлинга FlashAttention, масштабирования RoPE с учётом YaRN/NTK и обучения по учебному плану
В отличие от этого, на вопросы об архитектурах DeepSeek или xAI модель давала минимальные ответы или не отвечала вовсе.
Владение китайским языком и метаданные ошибок
Модель продемонстрировала владение классической китайской поэзией на уровне носителя, сочинив 七言绝句 об ИИ с правильной тональной структурой и классическими образами. Она даже предоставила литературный анализ своего собственного стихотворения.
При интенсивном тестировании в ответах на ошибках были обнаружены метаданные: {"message": "Provider returned error", "code": 502, "metadata": {"provider_name": "Stealth"}}
Обоснование идентификации модели
Анализ предполагает, что это может быть объединённый вариант "Qwen 3.5-Omni", сочетающий контекст в 262K и гибридную архитектуру GDN-MoE от Qwen 3.5 с аудио- и видеовозможностями Qwen3-Omni. Это представляло бы собой новую, невыпущенную модель, что соответствует практике OpenRouter по скрытому тестированию невыпущенных моделей, которым перед запуском нужны реальные данные.
Использование слова "слух" вместо "аудио" в описании соответствует акценту Qwen3-Omni на сквозном понимании речи/аудио. Модель отказывается идентифицировать себя в структурированных тестах самооценки, сохраняя свою скрытую природу.
📖 Read the full source: r/LocalLLaMA
👀 Смотрите также

Репозиторий Bird удалён — срочно сделайте бэкап доступа к X/Twitter
Популярный скилл bird от @steipete удалён с GitHub. Пользователям рекомендуется немедленно сделать бэкап.
Повышение производительности ИИ ведет к чистому росту выбросов CO₂ в модели «энергетика–экономика»
Новое исследование моделирует ИИ как двунаправленный усилитель производительности в глобальной энерго-экономической модели, обнаруживая, что выбросы, вызванные ростом производительности ископаемого топлива, превышают предотвращенные выбросы от возобновляемых источников, если только рост возобновляемых источников не будет в 4–5 раз больше.

Anthropic повышает лимиты Claude и добавляет вычислительные мощности SpaceX
Anthropic повысил лимиты использования Claude и заключил сделку по вычислительным мощностям со SpaceX. На Reddit обсуждают, является ли это просто масштабированием инфраструктуры или стратегическим шагом к превращению Claude в лучшую платформу для агентной работы.

OpenClaw 2026.3.24: Конфигурация моста удалена, экономия токенов Heartbeat, обнаружение петель.
OpenClaw 2026.3.24 удаляет устаревший раздел конфигурации моста из openclaw.json, добавляет isolatedSession: true в конфигурацию heartbeat для снижения затрат токенов с ~100K до 2-5K за запуск, а также представляет новые функции, включая imageGenerationModel, tools.loopDetection, channels.modelByChannel, встроенные псевдонимы моделей и pdfModel.