Pantheon-Reasoning-27B: Ein dichtes Reasoning-RP-Modell von Gryphe

Gryphe hat Pantheon-Reasoning-27B veröffentlicht, ein feinabgestimmtes Reasoning-Modell für Rollenspiele, das auf llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved basiert. Das Modell zielt darauf ab, strukturiertes Denken in die Charakterarbeit einzubringen – den Ton abwägen, narrative Schläge planen und überlegen, wie ein Charakter tatsächlich reagieren würde, bevor eine Zeile generiert wird.
Die Zusammensetzung der Trainingsdaten (alle mit vollständigen Reasoning-Spuren):
- Pantheon-Daten (~28%) – Kern-Rollenspiel-Korpus mit zurückgenerierten Reasoning-Spuren
- Opus-4.6-Reasoning-24k (~21%) – bereinigte Claude Opus 4.6 Reasoning-Spuren für MINT, Programmierung und Befehlsausführung
- WorldSim-Daten (~16%) – Langform-Opus-4.6-Erzählrollenspiel mit nativem Reasoning, hauptsächlich dritte Person Präsens
- Textadventure-Daten (~16%) – interaktive Fiktion und Textadventure-Inhalte mit zurückgeneriertem Reasoning
- Allgemeine Rollenspieldaten (~16%) – verschiedene Rollenspiel-Transkripte mit zurückgeneriertem Reasoning
- Tiamat-Daten (~3%) – Charakter-/RP-Datensatz von Tiamat-24B-Magistral mit mehrstufiger Verbesserungspipeline, Reasoning pro Austausch zurückgeneriert
Das Modell wurde mit preserve_thinking: true trainiert, sodass Denk-Tags über alle Assistenten-Turns in Multi-Turn-Gesprächen aktiv bleiben – nicht nur im ersten.
GGUF-Quants sind für die lokale Inferenz verfügbar. Die Wahl des Basismodells (Qwen 3.6 27B) erfolgte absichtlich zur Reduzierung von Verweigerungen und zur Verbesserung der Schreibfähigkeit. Gryphe merkt an, dass sie Gemma 4 31B in Betracht gezogen haben, es aber aufgrund architektonischer Eigenheiten als „absolute Pain zu trainieren“ empfanden.
📖 Vollständige Quelle lesen: r/LocalLLaMA
👀 Siehe auch

Claude Code v2.1.222: Worktree-Sicherheit, Proxy-Korrekturen und Nutzungsabrechnungs-Neugewichtung
Claude Code v2.1.222 behebt destruktive Git-Befehle in Worktree-isolierten Sitzungen, HTTPS-Proxy-Startprobleme, MCP-Nutzungsabrechnung und fügt SendMessage-Berechtigungsprüfungen hinzu.

Apple bietet kostenloses Private Cloud Computing für Indie-Entwickler mit unter 2 Millionen Downloads an
Apple kündigte auf der WWDC 2026 an, dass Entwickler mit weniger als 2 Millionen erstmaligen App Store-Downloads seine Foundation Models in Private Cloud Compute ohne Cloud-API-Kosten nutzen können. Das Framework erhält außerdem Bildeingabe und Unterstützung für Servermodelle.

Meta stoppt internes KI-Trainingsprogramm nach Datenleck mit Tastenanschlägen von Mitarbeitern
Meta pausiert das MCI-Programm zur Aufzeichnung von Tastatureingaben nach einem SEV-2-Leck, das private Gespräche, Leistungsdaten und Transkriptionen unternehmensweit offenlegte.

NVIDIA Vera CPU für agentische KI-Workloads gestartet
NVIDIA hat den Vera CPU vorgestellt, einen Prozessor, der speziell für agentische KI und Reinforcement-Learning-Workloads entwickelt wurde. Laut NVIDIA liefert er Ergebnisse mit 50 % schnellerer Leistung und doppelter Effizienz im Vergleich zu herkömmlichen Rack-Scale-CPUs.