OpenRouters Heiler-Alpha-Stealth-Modell scheint eine unveröffentlichte Variante von Qwen 3.5-Omni zu sein.

Technische Spezifikationen und Beweise
Healer Alpha wird als Modell mit "Seh-, Hör-, Denk- und Handlungsfähigkeiten" beschrieben, das visuelle und auditive Eingaben nativ wahrnimmt. Das Modell akzeptiert Text-, Bild-, Audio- und Videoeingaben und gibt Text mit einer maximalen Ausgabelänge von 65.536 Tokens aus.
Das Kontextfenster von 262.144 ist ein Schlüsselmerkmal – diese exakte Zahl (2^18) entspricht genau der nativen Kontextlänge von Qwen 3.5, nicht gerundet auf 256K. Andere Modelle verwenden unterschiedliche Längen: GPT-5.4 nutzt 272K, Gemini 1M und Claude 200K-1M.
Architekturwissen und Fähigkeiten
Auf Nachfrage zu Qwen-Architekturen lieferte Healer Alpha eine über 2.000 Wörter lange technische Erklärung, die Folgendes abdeckte:
- Qwen3-Omni Thinker-Talker-Architektur mit Aufteilung in Denk-/Generierungsprozesse
- Cross-modale Fusion und CosyVoice-Vocoder-Integration
- GDN (Gated Normalization Mechanism) und MoE-Experten-Routing
- 262K-Kontexthandhabung mittels Ring Attention, KV-Cache-Optimierung, FlashAttention-Tiling, YaRN/NTK-aware RoPE-Skalierung und Curriculum Learning
Im Gegensatz dazu lieferte es bei Nachfragen zu DeepSeek- oder xAI-Architekturen minimale oder keine Antworten.
Chinesische Sprachkompetenz und Fehler-Metadaten
Das Modell demonstrierte muttersprachliche Fähigkeiten in der Verfassung klassischer chinesischer Gedichte, indem es ein 七言绝句 über KI mit korrekter Tonstruktur und klassischer Bildsprache schrieb. Es lieferte sogar eine literarische Analyse seines eigenen Gedichts.
Während intensiver Tests enthüllten Fehlermeldungen Metadaten: {"message": "Provider returned error", "code": 502, "metadata": {"provider_name": "Stealth"}}
Modellidentifikationsbegründung
Die Analyse legt nahe, dass es sich um eine zusammengeführte "Qwen 3.5-Omni"-Variante handeln könnte, die Qwen 3.5s 262K-Kontext und hybride GDN-MoE-Architektur mit den Audio-/Video-Fähigkeiten von Qwen3-Omni kombiniert. Dies würde ein neues, unveröffentlichtes Modell darstellen, das zu OpenRouters Muster des heimlichen Testens unveröffentlichter Modelle passt, die vor dem Launch reale Daten benötigen.
Die Verwendung von "Hören" statt "Audio" in der Beschreibung entspricht Qwen3-Omnis Betonung des Ende-zu-Ende-Sprach-/Audio-Verständnisses. Das Modell weigert sich, sich in strukturierten Selbsteinschätzungstests zu identifizieren, und bewahrt so seinen verdeckten Charakter.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

AIME 2026 Ergebnisse: Offene und geschlossene Modelle ueber 90%
KI-Modelle erreichen 90%+ bei AIME 2026, DeepSeek V3.2 fuehrt den gesamten Test fuer nur bash.09 durch.

Claude-App belegt nach Pentagon-Streit zweiten Platz im US-App-Store
Die Claude-Chatbot-App von Anthropic stieg auf Platz zwei der kostenlosen Apps im US-App Store von Apple auf, nachdem sie Ende Januar 2026 noch außerhalb der Top 100 lag und bis Ende Februar den zweiten Platz erreichte. Dieser Anstieg folgte auf die öffentlichen Verhandlungen des Unternehmens mit dem Pentagon über Einschränkungen der KI-Nutzung.

RTX 5000 PRO 48GB liefert 4400 Tok/s Präzisions-Caching für Qwen3.6-27B
Ein PC-Neuling berichtet von 4400 tok/s Promptverarbeitung und 80 tok/s Generierung mit Qwen3.6-27B-FP8 und vollpräzisem KV-Cache auf einer einzelnen RTX 5000 Pro 48GB, unter Verwendung von vLLM und Claude Code.

"Untersuchen, welche Dateien im Kontextfenster eines Telegram-Chats enthalten sind"
Begleiten Sie uns, während wir das Verständnis dafür vertiefen, welche Dateien Teil des Kontextfensters eines Telegram-Chats sind und Ihr operatives Wissen erweitern.