Pantheon-Reasoning-27B: Um Modelo de RP de Raciocínio Denso da Gryphe

Gryphe lançou o Pantheon-Reasoning-27B, um modelo de raciocínio ajustado para roleplay construído sobre llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. O modelo visa trazer raciocínio estruturado para o trabalho de personagens — ponderando tom, planejando batidas narrativas e considerando como um personagem realmente responderia antes de gerar uma linha.
A composição dos dados de treinamento (todos com rastros completos de raciocínio):
- Dados Pantheon (~28%) — corpus central de roleplay com rastros de raciocínio gerados retroativamente
- Opus-4.6-Reasoning-24k (~21%) — rastros de raciocínio limpos do Claude Opus 4.6 para STEM, codificação e instrução
- Dados WorldSim (~16%) — roleplay narrativo longo do Opus 4.6 com raciocínio nativo, principalmente em terceira pessoa no presente
- Dados de aventura de texto (~16%) — ficção interativa e conteúdo de aventura de texto com raciocínio gerado retroativamente
- Dados gerais de roleplay (~16%) — transcrições variadas de roleplay com raciocínio gerado retroativamente
- Dados Tiamat (~3%) — conjunto de dados de personagem/RP do Tiamat-24B-Magistral com pipeline de melhoria em várias etapas, raciocínio gerado retroativamente por troca
O modelo foi treinado com preserve_thinking: true, então as tags de pensamento permanecem ativas em todas as viradas do assistente em conversas de múltiplas trocas — não apenas na primeira.
Quants GGUF estão disponíveis para inferência local. A escolha do modelo base (Qwen 3.6 27B) foi intencional para redução de recusas e capacidade de escrita. Gryphe observa que considerou o Gemma 4 31B, mas o achou "um absoluto pesadelo para treinar" devido a peculiaridades arquiteturais.
📖 Leia a fonte completa: r/LocalLLaMA
👀 See Also

Encíclica do Papa Leão XIV sobre IA: Principais Pontos para Desenvolvedores
O Vaticano publicou uma encíclica sobre ética em IA. O documento destaca problemas de interpretabilidade de LLMs, vieses culturais nos dados de treinamento e o custo ambiental da IA.

Resultados da Pesquisa sobre Confiabilidade e Padrões de Desenvolvimento de Agentes de IA
Uma sessão colaborativa de pesquisa com o Claude Opus analisou 15 artigos sobre agentes de IA, revelando problemas de confiabilidade quantificados: os agentes produzem 2 a 4 sequências de ações diferentes em 10 execuções, com 69% da divergência ocorrendo na primeira decisão. Agentes de autoaperfeiçoamento mostraram taxas de recusa de segurança caindo de 99,4% para 54,4% por meio de seu próprio aprendizado.

GitHub Copilot muda para cobrança baseada em uso por consumo de tokens, substituindo solicitações premium em 1º de junho de 2026
GitHub Copilot faz a transição de unidades de requisição premium para créditos de IA baseados em token, com preços dos planos inalterados. Todos os planos pagos incluem créditos mensais iguais ao custo da assinatura; uso adicional é cobrado nas taxas da API.

Provedor OpenClaw Mistral Quebrado Desde Atualização 2026.3.8, Comunidade Busca Alternativas
Usuários do OpenClaw relatam erros HTTP 422 persistentes com modelos Mistral desde a atualização 2026.3.8, sem correções nas versões subsequentes até a 2026.3.13. O problema afeta toda a funcionalidade relacionada ao Mistral, enquanto chamadas diretas à API funcionam normalmente.