OpenRouter bestätigt, dass die Hunter/Healer-Alpha-Modelle Varianten von MiMo V2 sind.

OpenRouters bisher nicht angekündigte Hunter Alpha- und Healer Alpha-Modelle wurden offiziell als MiMo V2-Varianten bestätigt. Die Identifizierung stammt von einem GitHub-Pull-Request, der die genauen Modellkonfigurationen angibt.
Modellspezifikationen
Laut dem Quellenmaterial:
- Hunter Alpha = MiMo V2 Pro reines Text-Verarbeitungsmodell
- Kontextfenster: 1.048.576 Tokens (1M)
- Maximale Tokens: 32.000
- Healer Alpha = MiMo V2 Omni Text + Bild-Verarbeitungsmodell
- Kontextfenster: 262.144 Tokens (262K)
- Maximale Tokens: 32.000
Die MiMo-Architektur (Mixture of Mixtures) repräsentiert einen spezifischen Ansatz im Modell-Design, der mehrere spezialisierte Komponenten kombiniert. Die Bezeichnung V2 Pro zeigt an, dass dies die zweite Version der reinen Text-Verarbeitungsvariante ist, während V2 Omni auf eine multimodale Version hindeutet, die sowohl Text als auch Bilder verarbeiten kann.
Zum Kontext: OpenRouter agiert als API-Aggregator, der Zugang zu mehreren KI-Modellen über eine einheitliche Schnittstelle bietet. Die Plattform listet typischerweise verfügbare Modelle mit ihren Spezifikationen, Preisen und Leistungsmetriken auf. Das 1M-Kontextfenster von Hunter Alpha ist besonders bemerkenswert, da es an die praktischen Grenzen aktueller Transformer-basierter Architekturen heranreicht und möglicherweise die Verarbeitung sehr langer Dokumente oder Gespräche ermöglicht.
Die Quelle erwähnt auch, dass "ein neues Modell kommt", obwohl im extrahierten Text keine Details zu dieser bevorstehenden Veröffentlichung angegeben werden.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

YC-Bench-Benchmark testet LLMs als Startup-CEOs, GLM-5 zeigt starke Kosteneffizienz
Forscher entwickelten YC-Bench, einen Benchmark, bei dem LLMs als CEOs simulierter Startups über ein Jahr hinweg agieren und Mitarbeiter, Verträge und Gehaltsabrechnungen verwalten. GLM-5 erzielte durchschnittlich 1,21 Mio. US-Dollar Endkapital bei 7,62 US-Dollar pro Durchlauf und lag damit innerhalb von 5 % von Claude Opus 4.6, das 86 US-Dollar pro Durchlauf kostete.

Goldman-Sachs-Analyse zeigt minimale Auswirkungen von KI auf das US-BIP-Wachstum 2025
Goldman-Sachs-Ökonomen berichten, dass KI-Investitionen im Jahr 2025 'praktisch null' zum US-BIP-Wachstum beigetragen haben, wobei importierte Hardware und nicht gemessene Produktivitätsauswirkungen als Schlüsselfaktoren genannt werden.

ThinkPads 34-jährige Laufzeit: Vom IBM 700C zu den KI-Workstations von Lenovo
ThinkPad wird seit 1992 kontinuierlich unter IBM und Lenovo ausgeliefert, mit visueller Kontinuität vom 700C bis zum P14s Gen 6 AMD von 2026, der 70B-LLM-Workloads lokal ausführt.

Mercury 2: Diffusionsbasiertes Modell für Echtzeit-KI-Codierung
Mercury 2 nutzt diffusionsbasierte Generierung anstelle sequentieller Token-für-Token-Dekodierung, generiert Token parallel und verfeinert sie über mehrere Schritte und beansprucht 1.009 Token/Sekunde auf NVIDIA Blackwell GPUs mit Preisen von 0,25 USD/1 Mio. Eingabe-Token und 0,75 USD/1 Mio. Ausgabe-Token.