Pantheon-Reasoning-27B : Un modèle de RP à raisonnement dense de Gryphe

✍️ OpenClawRadar📅 Publié: June 17, 2026🔗 Source
Pantheon-Reasoning-27B : Un modèle de RP à raisonnement dense de Gryphe
Ad

Gryphe a publié Pantheon-Reasoning-27B, un modèle de raisonnement affiné pour le jeu de rôle basé sur llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Le modèle vise à apporter un raisonnement structuré au travail sur les personnages — peser le ton, planifier les rebonds narratifs, et réfléchir à la façon dont un personnage réagirait avant de générer une réplique.

La composition des données d'entraînement (toutes avec traces de raisonnement complètes) :

  • Données Pantheon (~28%) — corpus de jeu de rôle principal avec traces de raisonnement générées a posteriori
  • Opus-4.6-Reasoning-24k (~21%) — traces de raisonnement nettoyées de Claude Opus 4.6 pour STEM, codage et suivi d'instructions
  • Données WorldSim (~16%) — jeu de rôle narratif long de Opus 4.6 avec raisonnement natif, principalement à la troisième personne au présent
  • Données d'aventures textuelles (~16%) — fiction interactive et contenu d'aventure textuelle avec raisonnement généré a posteriori
  • Données de jeu de rôle général (~16%) — transcriptions variées de RP avec raisonnement généré a posteriori
  • Données Tiamat (~3%) — ensemble de données de personnages/RP de Tiamat-24B-Magistral avec pipeline d'amélioration multi-étapes, raisonnement généré a posteriori par échange

Le modèle a été entraîné avec preserve_thinking: true, donc les balises de réflexion restent actives sur tous les tours de l'assistant dans les conversations multi-tours — pas seulement le premier.

Ad

Des quantifications GGUF sont disponibles pour l'inférence locale. Le choix du modèle de base (Qwen 3.6 27B) était intentionnel pour réduire les refus et améliorer la capacité d'écriture. Gryphe note qu'ils ont envisagé Gemma 4 31B mais l'ont trouvé « absolument pénible à entraîner » en raison de particularités architecturales.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Claude Code ajoute l'exécution de tâches planifiées pour les flux de travail automatisés.
News

Claude Code ajoute l'exécution de tâches planifiées pour les flux de travail automatisés.

Anthropic a activé l'exécution planifiée pour Claude Code, permettant aux développeurs de configurer des tâches une seule fois et de les exécuter automatiquement sans sollicitation manuelle. Cette fonctionnalité prend en charge les revues de commit quotidiennes, les audits de dépendances, les analyses de journaux d'erreurs et les revues de PR.

OpenClawRadar
Anthropic rapporte des preuves de distillation massive de Claude par des concurrents en IA
News

Anthropic rapporte des preuves de distillation massive de Claude par des concurrents en IA

Anthropic a partagé des preuves que DeepSeek, Moonshot et MiniMax utilisaient environ 24 000 faux comptes pour effectuer une distillation massive de Claude, avec plus de 16 millions d'échanges enregistrés.

OpenClawRadar
Ubuntu Linux intégrera des fonctionnalités d'IA au cours de l'année à venir, en commençant par l'inférence locale.
News

Ubuntu Linux intégrera des fonctionnalités d'IA au cours de l'année à venir, en commençant par l'inférence locale.

Canonical annonce une poussée pluriannuelle en matière d'IA pour Ubuntu, axée sur l'inférence locale, les flux de travail agentiques et les capacités de système d'exploitation contextuelles, avec des fonctionnalités déployées tout au long de 2026.

OpenClawRadar
Le filtre de politique de Claude bloque les travaux de bioinformatique impliquant des noms d'agents pathogènes.
News

Le filtre de politique de Claude bloque les travaux de bioinformatique impliquant des noms d'agents pathogènes.

Un chercheur en virologie computationnelle signale que le filtre de politique d'utilisation de Claude signale comme problématiques des scripts légitimes de bioinformatique lorsque des pathogènes sont nommés, nécessitant des contournements comme décrire les tâches sans nommer les organismes ou rétrograder vers Sonnet 4. Le problème affecte Claude Code, claude.ai, et les modèles Opus 4.6 et Sonnet 4.6.

OpenClawRadar