Zwei neue Modelle erscheinen auf OpenRouter, möglicherweise Varianten von DeepSeek V4.

Auf OpenRouter sind zwei neue Modelle aufgetaucht, bei denen es sich um Testversionen von DeepSeek V4 handeln könnte. Die Modelle heißen healer-alpha und hunter-alpha, wobei die Beschreibungen darauf hindeuten, dass es sich bei einem um eine Lite-Version und beim anderen um ein vollwertiges Modell handelt.
Modellspezifikationen
Die Vollversion soll angeblich 1 TB Parameter und 1 M Kontext haben, was mit durchgesickerten Informationen zu DeepSeek V4 übereinstimmt. Die Lite-Version wird als leichtere Variante derselben Modellfamilie beschrieben.
Erste Testergebnisse
Ein Nutzer führte Rollenspieltests durch, um Filterstufen und Leistung zu bewerten:
- Beide Modelle schnitten in Rollenspielszenarien beeindruckend ab
- Keines der Modelle lehnte während der Tests Nachrichten ab
- Die Lite-Version ist deutlich schneller als die Vollversion
- Die Vollversion ist langsamer, aber immer noch reaktionsschnell
- Beide Modelle generieren die gleiche Anzahl an Tokens in weniger als der Hälfte der Zeit im Vergleich zu GLM 5.0
- Die Lite-Version ist etwas schwächer in der Leistung, aber nicht wesentlich
- Beide Modelle bewahren Charakterkonsistenz und verarbeiten "würzige" Inhalte gut
Die Modelle befinden sich derzeit in der Alpha-Phase, was das Fehlen von Nachrichtenfilterung während der Tests erklären könnte. Die Community diskutiert, ob es sich tatsächlich um DeepSeek V4-Varianten handelt, und tauscht weitere Testergebnisse aus.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Anthropics Mythos-Leak enthüllt latentes Hochleistungssystem
Durchgesickerte Dokumente beschreiben Claude Mythos als einen 'Leistungssprung' mit 'beispiellosen Cybersicherheitsrisiken' und fortschrittlichen Cyberfähigkeiten, während die Bewertung von Anthropic mit 380 Milliarden Dollar strukturelle Anreize schafft, eine öffentliche 'Sicherheits'-Erzählung aufrechtzuerhalten.

Zwei Forschungsprojekte stellen Imitationslernen für Web-Agenten in Frage
Zwei Forschungsprojekte zeigen die Grenzen rein imitativen Trainings für Web-Agenten auf: 'Browser in the Loop' nutzt RL mit einem 8-Milliarden-Parameter-Modell, um den Erfolg bei Formularübermittlungen zu verbessern, während 'Concentrate or Collapse' zeigt, dass Standard-RL bei Diffusionssprachmodellen versagt und sequenzielle Optimierung erfordert.

Apple bietet kostenloses Private Cloud Computing für Indie-Entwickler mit unter 2 Millionen Downloads an
Apple kündigte auf der WWDC 2026 an, dass Entwickler mit weniger als 2 Millionen erstmaligen App Store-Downloads seine Foundation Models in Private Cloud Compute ohne Cloud-API-Kosten nutzen können. Das Framework erhält außerdem Bildeingabe und Unterstützung für Servermodelle.

1-Bit Bonsai Image 4B: Bildgenerierung auf dem Gerät mittels Binary/Ternary FLUX.2
PrismML veröffentlicht Bonsai Image 4B, eine binäre (1,125 Bit) und ternäre (1,71 Bit) FLUX.2 Klein 4B-Variante, die den Diffusionstransformer auf 0,93 GB / 1,21 GB schrumpft und so die 512×512-Bildgenerierung auf dem iPhone 17 Pro Max in 9,4 Sekunden ermöglicht.