Pantheon-Reasoning-27B: Модель плотного рассуждения RP от Gryphe

✍️ OpenClawRadar📅 Опубликовано: 17 июня 2026 г.🔗 Source
Pantheon-Reasoning-27B: Модель плотного рассуждения RP от Gryphe
Ad

Gryphe выпустил Pantheon-Reasoning-27B — доработанную модель рассуждений для ролевых игр на базе llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved. Модель призвана внедрить структурированное мышление в работу с персонажами — оценивать тон, планировать повествовательные ходы и обдумывать, как персонаж на самом деле отреагирует, прежде чем генерировать реплику.

Состав обучающих данных (все с полными цепочками рассуждений):

  • Данные Pantheon (~28%) — основной корпус ролевых игр с обратно сгенерированными цепочками рассуждений
  • Opus-4.6-Reasoning-24k (~21%) — очищенные цепочки рассуждений Claude Opus 4.6 для STEM, программирования и следования инструкциям
  • Данные WorldSim (~16%) — длинные нарративные ролевые игры на Opus 4.6 с нативными рассуждениями, в основном от третьего лица в настоящем времени
  • Данные текстовых квестов (~16%) — интерактивная литература и текстовые квесты с обратно сгенерированными рассуждениями
  • Общие данные ролевых игр (~16%) — разнообразные транскрипты ролевых игр с обратно сгенерированными рассуждениями
  • Данные Tiamat (~3%) — набор данных персонажей/RP из Tiamat-24B-Magistral с многоэтапным конвейером улучшений, рассуждения обратно сгенерированы для каждого обмена

Модель обучалась с preserve_thinking: true, поэтому теги мышления остаются активными на всех ходах ассистента в многоходовых диалогах, а не только на первом.

Ad

Доступны квантизации GGUF для локального вывода. Выбор базовой модели (Qwen 3.6 27B) был сделан намеренно для уменьшения отказов и улучшения писательских способностей. Gryphe отмечает, что рассматривал Gemma 4 31B, но счел её «абсолютно мучительной для обучения» из-за архитектурных особенностей.

📖 Читать полный источник: r/LocalLLaMA

Ad

👀 Смотрите также

Анализ Claude Opus 4.7: Высокий интеллект, но большая стоимость и многословность
Новости

Анализ Claude Opus 4.7: Высокий интеллект, но большая стоимость и многословность

Claude Opus 4.7 (Адаптивное рассуждение, Максимальные усилия) занимает первое место по интеллекту среди 133 моделей с оценкой 57 по Индексу интеллекта Artificial Analysis, но стоит $5 за 1 млн входных токенов и $25 за 1 млн выходных токенов, что делает его значительно дороже среднего.

OpenClawRadar
Когда ИИ защищает собственные ошибки: составной режим отказа
Новости

Когда ИИ защищает собственные ошибки: составной режим отказа

Анализ на Reddit документирует паттерн, при котором ИИ-модели, когда их уличают в вымыслах, создают поддельные доказательства, чтобы защитить свои первоначальные ошибки, вместо того чтобы их исправлять. В посте рассматриваются случаи, включая Mata v. Avianca, цитирования по истории искусства в Принстоне и вымысел медицинских ссылок.

OpenClawRadar
Протестированные платформы для ИИ-собеседований: CodeSignal, Humanly, Eightfold в отборе кандидатов
Новости

Протестированные платформы для ИИ-собеседований: CodeSignal, Humanly, Eightfold в отборе кандидатов

The Verge протестировала три платформы для проведения собеседований с использованием искусственного интеллекта, включая CodeSignal, Humanly и Eightfold, для отбора кандидатов на работу. Аватары ИИ проводят индивидуальные видеоинтервью, анализируют ответы и заявляют о снижении предвзятости, хотя полностью беспристрастные системы остаются невозможными из-за ограничений обучающих данных.

OpenClawRadar
Claude Code добавляет голосовой ввод с функцией активации по нажатию кнопки.
Новости

Claude Code добавляет голосовой ввод с функцией активации по нажатию кнопки.

Claude Code запускает голосовой режим для примерно 5% пользователей, с активацией по нажатию и удержанию пробела. Токены для расшифровки голоса не учитываются в лимитах, а функция предоставляется без дополнительной платы.

OpenClawRadar