Pantheon-Reasoning-27B: Gryphe의 고밀도 추론 RP 모델

Gryphe가 Pantheon-Reasoning-27B를 출시했습니다. 이 모델은 llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved를 기반으로 롤플레이를 위한 파인튜닝된 추론 모델입니다. 이 모델은 캐릭터 작업에 구조화된 추론을 도입하여, 대사 생성 전에 어조를 평가하고, 내러티브 비트를 계획하며, 캐릭터의 실제 반응 방식을 고려하는 것을 목표로 합니다.
학습 데이터 구성(모두 완전한 추론 과정 포함):
- Pantheon 데이터 (~28%) — 핵심 롤플레이 코퍼스에 역 생성된 추론 과정 포함
- Opus-4.6-Reasoning-24k (~21%) — STEM, 코딩, 지시 수행을 위한 Claude Opus 4.6 추론 과정 정리
- WorldSim 데이터 (~16%) — 긴 형식의 Opus 4.6 내러티브 롤플레이, 주로 3인칭 현재 시제, 고유 추론 포함
- 텍스트 어드벤처 데이터 (~16%) — 인터랙티브 픽션 및 텍스트 어드벤처 콘텐츠에 역 생성된 추론 포함
- 일반 롤플레이 데이터 (~16%) — 다양한 롤플레이 대화록에 역 생성된 추론 포함
- Tiamat 데이터 (~3%) — Tiamat-24B-Magistral의 캐릭터/RP 데이터셋, 다단계 개선 파이프라인, 각 교환에 역 생성된 추론 포함
모델은 preserve_thinking: true로 학습되어, 다중 턴 대화에서 첫 번째 턴뿐만 아니라 모든 어시스턴트 턴에 thinking 태그가 활성화됩니다.
GGUF 양자화 파일은 로컬 추론에 사용할 수 있습니다. 기본 모델로 Qwen 3.6 27B를 선택한 것은 거부 감소와 글쓰기 능력 향상을 위한 의도적인 결정이었습니다. Gryphe는 Gemma 4 31B도 고려했지만, 아키텍처상의 문제로 인해 "훈련하기가 절대적으로 고통스럽다"고 언급했습니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also
AI 지원 개발은 스테이크 요리와 같다: 시작은 쉽지만, 마스터하기는 어렵다
개발자의 비유: AI는 코드를 빠르게 생성할 수 있지만, 일관되게 좋은 소프트웨어를 만들기 위해서는 여전히 깊은 이해, 판단력, 경험이 필요합니다.

아틀라시안, AI 전환 일환으로 1,600명 감원 발표
Hacker News에 공유된 로이터 보도에 따르면, Atlassian은 AI 개발에 초점을 맞추기 위해 약 1,600개의 직위를 줄일 계획입니다.
로컬 AI 비디오 파이프라인을 위한 실제 도구 호출에서 Qwen3 27B가 Gemma 4 26B를 능가
로컬 AI 비디오 파이프라인 실험에서 Qwen3 27B가 도구 호출을 깔끔하게 처리한 반면 Gemma 4 26B는 루프에 갇혔습니다. 또한 로컬 이미지 생성용 Said Image Turbo와 174K 컨텍스트를 달성한 OpenCode 오케스트레이션을 다룹니다.
Claude Code v2.1.269: 플러그인 평가 스위트, /output-style 전환 및 동시 에이전트 제한
Claude Code v2.1.269는 점수화되고 재현 가능한 플러그인 테스트 실행을 위한 `claude plugin eval`, Remote Control과 헤드리스 세션에서의 `/output-style` 전환, 최대 256까지 지원하는 CLAUDE_CODE_WORKFLOW_MAX_CONCURRENT_AGENTS를 추가했습니다.