Pantheon-Reasoning-27B: Модель плотного рассуждения RP от Gryphe

Gryphe выпустил Pantheon-Reasoning-27B — доработанную модель рассуждений для ролевых игр на базе llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Модель призвана внедрить структурированное мышление в работу с персонажами — оценивать тон, планировать повествовательные ходы и обдумывать, как персонаж на самом деле отреагирует, прежде чем генерировать реплику.
Состав обучающих данных (все с полными цепочками рассуждений):
- Данные Pantheon (~28%) — основной корпус ролевых игр с обратно сгенерированными цепочками рассуждений
- Opus-4.6-Reasoning-24k (~21%) — очищенные цепочки рассуждений Claude Opus 4.6 для STEM, программирования и следования инструкциям
- Данные WorldSim (~16%) — длинные нарративные ролевые игры на Opus 4.6 с нативными рассуждениями, в основном от третьего лица в настоящем времени
- Данные текстовых квестов (~16%) — интерактивная литература и текстовые квесты с обратно сгенерированными рассуждениями
- Общие данные ролевых игр (~16%) — разнообразные транскрипты ролевых игр с обратно сгенерированными рассуждениями
- Данные Tiamat (~3%) — набор данных персонажей/RP из Tiamat-24B-Magistral с многоэтапным конвейером улучшений, рассуждения обратно сгенерированы для каждого обмена
Модель обучалась с preserve_thinking: true, поэтому теги мышления остаются активными на всех ходах ассистента в многоходовых диалогах, а не только на первом.
Доступны квантизации GGUF для локального вывода. Выбор базовой модели (Qwen 3.6 27B) был сделан намеренно для уменьшения отказов и улучшения писательских способностей. Gryphe отмечает, что рассматривал Gemma 4 31B, но счел её «абсолютно мучительной для обучения» из-за архитектурных особенностей.
📖 Читать полный источник: r/LocalLLaMA
👀 Смотрите также

Анализ Claude Opus 4.7: Высокий интеллект, но большая стоимость и многословность
Claude Opus 4.7 (Адаптивное рассуждение, Максимальные усилия) занимает первое место по интеллекту среди 133 моделей с оценкой 57 по Индексу интеллекта Artificial Analysis, но стоит $5 за 1 млн входных токенов и $25 за 1 млн выходных токенов, что делает его значительно дороже среднего.

Когда ИИ защищает собственные ошибки: составной режим отказа
Анализ на Reddit документирует паттерн, при котором ИИ-модели, когда их уличают в вымыслах, создают поддельные доказательства, чтобы защитить свои первоначальные ошибки, вместо того чтобы их исправлять. В посте рассматриваются случаи, включая Mata v. Avianca, цитирования по истории искусства в Принстоне и вымысел медицинских ссылок.

Протестированные платформы для ИИ-собеседований: CodeSignal, Humanly, Eightfold в отборе кандидатов
The Verge протестировала три платформы для проведения собеседований с использованием искусственного интеллекта, включая CodeSignal, Humanly и Eightfold, для отбора кандидатов на работу. Аватары ИИ проводят индивидуальные видеоинтервью, анализируют ответы и заявляют о снижении предвзятости, хотя полностью беспристрастные системы остаются невозможными из-за ограничений обучающих данных.

Claude Code добавляет голосовой ввод с функцией активации по нажатию кнопки.
Claude Code запускает голосовой режим для примерно 5% пользователей, с активацией по нажатию и удержанию пробела. Токены для расшифровки голоса не учитываются в лимитах, а функция предоставляется без дополнительной платы.