Pantheon-Reasoning-27B: Модель плотного рассуждения RP от Gryphe

Gryphe выпустил Pantheon-Reasoning-27B — доработанную модель рассуждений для ролевых игр на базе llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Модель призвана внедрить структурированное мышление в работу с персонажами — оценивать тон, планировать повествовательные ходы и обдумывать, как персонаж на самом деле отреагирует, прежде чем генерировать реплику.
Состав обучающих данных (все с полными цепочками рассуждений):
- Данные Pantheon (~28%) — основной корпус ролевых игр с обратно сгенерированными цепочками рассуждений
- Opus-4.6-Reasoning-24k (~21%) — очищенные цепочки рассуждений Claude Opus 4.6 для STEM, программирования и следования инструкциям
- Данные WorldSim (~16%) — длинные нарративные ролевые игры на Opus 4.6 с нативными рассуждениями, в основном от третьего лица в настоящем времени
- Данные текстовых квестов (~16%) — интерактивная литература и текстовые квесты с обратно сгенерированными рассуждениями
- Общие данные ролевых игр (~16%) — разнообразные транскрипты ролевых игр с обратно сгенерированными рассуждениями
- Данные Tiamat (~3%) — набор данных персонажей/RP из Tiamat-24B-Magistral с многоэтапным конвейером улучшений, рассуждения обратно сгенерированы для каждого обмена
Модель обучалась с preserve_thinking: true, поэтому теги мышления остаются активными на всех ходах ассистента в многоходовых диалогах, а не только на первом.
Доступны квантизации GGUF для локального вывода. Выбор базовой модели (Qwen 3.6 27B) был сделан намеренно для уменьшения отказов и улучшения писательских способностей. Gryphe отмечает, что рассматривал Gemma 4 31B, но счел её «абсолютно мучительной для обучения» из-за архитектурных особенностей.
📖 Читать полный источник: r/LocalLLaMA
👀 Смотрите также

Claude теперь подключается к Adobe Creative Cloud, Blender, Ableton и другим
Anthropic выпускает коннекторы для Claude, позволяющие интегрироваться с Adobe Creative Cloud, Affinity, Blender, Ableton, Splice и Autodesk, чтобы управлять приложениями и получать данные с помощью естественного языка.
Клод улучшает границу нулей гипотезы Римана с 41,6% до 67,2%
Невыпущенная исследовательская версия Claude улучшила нижнюю границу для нулей на критической линии с 41,6% до 67,2%, используя новую комбинацию предыдущих работ.

Claude Code v2.1.73: Переопределения моделей, исправления стабильности и улучшения производительности
Claude Code v2.1.73 добавляет modelOverrides для пользовательских идентификаторов провайдеров, исправляет критические зависания и взаимные блокировки, решает проблему понижения версий моделей у суб-агентов и улучшает стабильность голосового режима. В выпуске устранены 18 конкретных проблем, включая запросы разрешений для bash-команд, повреждение сессий и сбои песочницы Linux.

MCP — это просто переупакованные библиотеки: дежавю повторяется
Обсуждение на Reddit утверждает, что MCP от Anthropic — это, по сути, переупаковка программных библиотек, проводя параллели с дизайном инструментов smolagents от Hugging Face и задаваясь вопросом, стоит ли создавать новые MCP или улучшать документацию существующих библиотек.