Pantheon-Reasoning-27B: Um Modelo de RP de Raciocínio Denso da Gryphe

Gryphe lançou o Pantheon-Reasoning-27B, um modelo de raciocínio ajustado para roleplay construído sobre llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. O modelo visa trazer raciocínio estruturado para o trabalho de personagens — ponderando tom, planejando batidas narrativas e considerando como um personagem realmente responderia antes de gerar uma linha.
A composição dos dados de treinamento (todos com rastros completos de raciocínio):
- Dados Pantheon (~28%) — corpus central de roleplay com rastros de raciocínio gerados retroativamente
- Opus-4.6-Reasoning-24k (~21%) — rastros de raciocínio limpos do Claude Opus 4.6 para STEM, codificação e instrução
- Dados WorldSim (~16%) — roleplay narrativo longo do Opus 4.6 com raciocínio nativo, principalmente em terceira pessoa no presente
- Dados de aventura de texto (~16%) — ficção interativa e conteúdo de aventura de texto com raciocínio gerado retroativamente
- Dados gerais de roleplay (~16%) — transcrições variadas de roleplay com raciocínio gerado retroativamente
- Dados Tiamat (~3%) — conjunto de dados de personagem/RP do Tiamat-24B-Magistral com pipeline de melhoria em várias etapas, raciocínio gerado retroativamente por troca
O modelo foi treinado com preserve_thinking: true, então as tags de pensamento permanecem ativas em todas as viradas do assistente em conversas de múltiplas trocas — não apenas na primeira.
Quants GGUF estão disponíveis para inferência local. A escolha do modelo base (Qwen 3.6 27B) foi intencional para redução de recusas e capacidade de escrita. Gryphe observa que considerou o Gemma 4 31B, mas o achou "um absoluto pesadelo para treinar" devido a peculiaridades arquiteturais.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Teste de Raciocínio Espacial de LLM: Benchmark Sokoban Mostra ChatGPT, Qwen3.7-max, Gemini 3.5-thinking na Liderança
Um benchmark personalizado de Sokoban testou o raciocínio espacial zero-shot em LLMs com formatação rigorosa. Apenas ChatGPT, Qwen3.7-max e Gemini 3.5-thinking passaram. Modelos como Gemini 3.5-flash e Qwen3.7-plus falharam devido a movimentos ilegais ou deadlocks.

Claude Code v2.1.222: Segurança de Worktree, Correções de Proxy e Reequilíbrio de Cobrança de Uso
Claude Code v2.1.222 corrige comandos git destrutivos em sessões isoladas de worktree, travamentos de inicialização com proxy HTTPS, cobrança de uso de MCP e adiciona verificações de permissão SendMessage.

Revisão de Código do GitHub Copilot consumirá minutos do Actions a partir de 1º de junho de 2026
A partir de 1º de junho de 2026, as revisões de código do GitHub Copilot em repositórios privados consumirão minutos do GitHub Actions, além de Créditos de IA. Repositórios públicos permanecem gratuitos.

Curso de Transformadores da Stanford CS 25 Aberto ao Público com Transmissão ao Vivo
O seminário CS 25 Transformers de Stanford está agora aberto ao público, com palestras começando em 23 de janeiro de 2025, das 16h30 às 17h50 PDT, disponível presencialmente no Skilling Auditorium ou via Zoom, com gravações postadas online.