Pantheon-Reasoning-27B: Un modelo de RP de razonamiento denso de Gryphe

Gryphe ha lanzado Pantheon-Reasoning-27B, un modelo de razonamiento ajustado para juegos de rol basado en llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. El modelo busca aportar razonamiento estructurado al trabajo de personajes: sopesar el tono, planificar los giros narrativos y considerar cómo respondería realmente un personaje antes de generar una línea.
La composición de los datos de entrenamiento (todos con trazas de razonamiento completas):
- Datos de Pantheon (~28%) — corpus principal de rol con trazas de razonamiento generadas a posteriori
- Opus-4.6-Reasoning-24k (~21%) — trazas de razonamiento limpias de Claude Opus 4.6 para STEM, programación y seguimiento de instrucciones
- Datos de WorldSim (~16%) — juego de rol narrativo extenso de Opus 4.6 con razonamiento nativo, principalmente en tercera persona y tiempo presente
- Datos de aventuras de texto (~16%) — ficción interactiva y contenido de aventuras de texto con razonamiento generado a posteriori
- Datos generales de rol (~16%) — transcripciones variadas de rol con razonamiento generado a posteriori
- Datos de Tiamat (~3%) — conjunto de datos de personajes/RP de Tiamat-24B-Magistral con un proceso de mejora de múltiples pasos, razonamiento generado a posteriori por intercambio
El modelo se entrenó con preserve_thinking: true, por lo que las etiquetas de pensamiento permanecen activas en todos los turnos del asistente en conversaciones de múltiples turnos, no solo en el primero.
Las cuantizaciones GGUF están disponibles para inferencia local. La elección del modelo base (Qwen 3.6 27B) fue intencionada para reducir el rechazo y mejorar la capacidad de escritura. Gryphe señala que consideraron Gemma 4 31B, pero descubrieron que era "un dolor absoluto de entrenar" debido a peculiaridades arquitectónicas.
📖 Lee la fuente completa: r/LocalLLaMA
👀 Ver también

Picos repentinos de 'Advertencia honesta' de Claude Code: Análisis basado en datos de r/ClaudeAI
Un usuario de Reddit rastreó el aumento de la frase 'honest caveat' como advertencia en los resultados de Claude Code utilizando recuentos de resultados de búsqueda de Google como medida de frecuencia aproximada.

Errores Elevados en Claude Opus 4.7: Actualización de Estado y Qué Esperar
Claude Opus 4.7 está experimentando errores elevados a partir del 2026-05-19T15:21Z. Consulta status.claude.com para ver el progreso y las resoluciones.

Anotaciones de Amazon S3: 1GB de metadatos por objeto para flujos de trabajo de agentes de IA
AWS anuncia anotaciones S3 — hasta 1.000 anotaciones por objeto, cada una de hasta 1 MB, totalizando 1 GB. Mutables, consultables mediante Athena, sin cargos de recuperación para objetos Glacier.

Propuesta de Enrutamiento de Inferencia Adaptativa para la Eficiencia de Consultas de IA
Una propuesta presentada a Anthropic en abril de 2026 describe un sistema de cinco pasos para dirigir consultas a modelos de IA apropiados según una puntuación de complejidad, utilizando señales simples como el recuento de caracteres y de oraciones antes de que ocurra cualquier inferencia del modelo.