Pantheon-Reasoning-27B: Gryphe의 고밀도 추론 RP 모델

Gryphe가 Pantheon-Reasoning-27B를 출시했습니다. 이 모델은 llmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preserved를 기반으로 롤플레이를 위한 파인튜닝된 추론 모델입니다. 이 모델은 캐릭터 작업에 구조화된 추론을 도입하여, 대사 생성 전에 어조를 평가하고, 내러티브 비트를 계획하며, 캐릭터의 실제 반응 방식을 고려하는 것을 목표로 합니다.
학습 데이터 구성(모두 완전한 추론 과정 포함):
- Pantheon 데이터 (~28%) — 핵심 롤플레이 코퍼스에 역 생성된 추론 과정 포함
- Opus-4.6-Reasoning-24k (~21%) — STEM, 코딩, 지시 수행을 위한 Claude Opus 4.6 추론 과정 정리
- WorldSim 데이터 (~16%) — 긴 형식의 Opus 4.6 내러티브 롤플레이, 주로 3인칭 현재 시제, 고유 추론 포함
- 텍스트 어드벤처 데이터 (~16%) — 인터랙티브 픽션 및 텍스트 어드벤처 콘텐츠에 역 생성된 추론 포함
- 일반 롤플레이 데이터 (~16%) — 다양한 롤플레이 대화록에 역 생성된 추론 포함
- Tiamat 데이터 (~3%) — Tiamat-24B-Magistral의 캐릭터/RP 데이터셋, 다단계 개선 파이프라인, 각 교환에 역 생성된 추론 포함
모델은 preserve_thinking: true로 학습되어, 다중 턴 대화에서 첫 번째 턴뿐만 아니라 모든 어시스턴트 턴에 thinking 태그가 활성화됩니다.
GGUF 양자화 파일은 로컬 추론에 사용할 수 있습니다. 기본 모델로 Qwen 3.6 27B를 선택한 것은 거부 감소와 글쓰기 능력 향상을 위한 의도적인 결정이었습니다. Gryphe는 Gemma 4 31B도 고려했지만, 아키텍처상의 문제로 인해 "훈련하기가 절대적으로 고통스럽다"고 언급했습니다.
📖 전체 출처 읽기: r/LocalLLaMA
👀 See Also

Anthropic의 Claude Fable 5: 신화 등급 능력, 데이터 보존 필요
Anthropic이 내일 Claude Fable 5를 출시합니다. Mythos급 성능과 강화된 가드레일을 갖춘 가장 진보된 공개 모델로, 데이터 보존이 필요할 가능성이 높습니다.

메릴랜드 주민들, 타주 AI 데이터 센터 위해 20억 달러 전력망 업그레이드 부담 — 주정부 FERC에 이의 제기
메릴랜드 주민 대표 사무소는 PJM Interconnection에 대해 FERC에 불만을 제기했습니다. PJM은 220억 달러 규모의 그리드 업그레이드 비용 중 20억 달러를 메릴랜드 고객에게 할당하여 주거용 고객당 약 345달러의 비용을 초래했으며, 이는 주로 타주 AI 데이터 센터에 혜택을 주기 위한 것입니다.

16GB M4 Mac에서 상시 작동 에이전트로 Qwen 35B-A3B 실행 시: RAM보다 먼저 디스크 I/O 실패
16GB M4 Mac에서 llama.cpp로 Qwen 35B-A3B를 실행하면 배치 추론은 가능하지만, Claude Code 및 Codex CLI와 함께 항상 켜져 있는 에이전틱 루프를 돌리면 SSD 경합이 발생하여 시스템 불안정과 크론 작업 누락을 초래합니다. RAM은 문제가 없음에도 불구하고요.

Anthropic Claude 유저, 유료 계정에서 기능 제한 조용히 적용됐다고 보고
Claude 유료 구독자가 보고한 바에 따르면, 배포 수준에서 시스템 프롬프트에 제한이 내장되어 모든 세션에서 셸/배시 실행 기능이 작동을 멈췄으며, 이에 대한 통보는 없었다고 합니다. 사용자는 여러 지원 티켓과 항의 양식을 제출했지만 응답을 받지 못한 채 계속해서 요금이 청구되고 있습니다.