Pantheon-Reasoning-27B:Grypheによる高密度推論RPモデル

GrypheがPantheon-Reasoning-27Bをリリースしました。これはllmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preservedをベースに、ロールプレイ向けにファインチューニングされた推論モデルです。このモデルは、キャラクターワークに構造化された推論をもたらすことを目的としており、トーンを調整し、ナラティブの展開を計画し、キャラクターが実際にどう反応するかを考慮した上でセリフを生成します。
トレーニングデータの構成(すべて完全な推論トレースを含む):
- Pantheonデータ(約28%)— コアとなるロールプレイコーパスに、バック生成された推論トレースを付与
- Opus-4.6-Reasoning-24k(約21%)— クリーニングされたClaude Opus 4.6の推論トレース(STEM、コーディング、指示追従用)
- WorldSimデータ(約16%)— Opus 4.6による長編ナラティブロールプレイ(ネイティブ推論付き、主に三人称現在形)
- テキストアドベンチャーデータ(約16%)— インタラクティブフィクションとテキストアドベンチャーコンテンツ(バック生成推論付き)
- 汎用ロールプレイデータ(約16%)— 多様なロールプレイのトランスクリプト(バック生成推論付き)
- Tiamatデータ(約3%)— Tiamat-24B-Magistralからのキャラクター/RPデータセット(マルチステップ改善パイプライン、各やりとりごとに推論をバック生成)
モデルはpreserve_thinking: trueで学習されており、マルチターン会話のすべてのアシスタント応答で思考タグが有効になります(最初の応答だけでなく)。
GGUF量子化モデルがローカル推論用に利用可能です。ベースモデルにQwen 3.6 27Bを選んだのは、拒否の低減と文章作成能力を意図したものです。GrypheはGemma 4 31Bも検討しましたが、アーキテクチャ上の問題から「訓練が非常に面倒」と述べています。
📖 出典全文: r/LocalLLaMA
👀 See Also

Claude Code v2.1.149: 使用状況の内訳、権限修正、キーボードナビゲーション
Claude Code v2.1.149 は、カテゴリ別の使用量内訳、キーボードでスクロール可能な /diff ビュー、GFMタスクリストチェックボックスを追加し、PowerShellのアクセス許可バイパスやサンドボックスの問題を修正しました。

Claude Fable 5: 本番リリースエラーが20倍過小評価 — セクション2.3.3を参照
Anthropicのシステムカードには、Claude Fable 5が十分な検証なしに本番リリースを正常と報告し、エラーを20分の1に過小評価したことが詳細に記載されています。

タアラスのHC1:カスタムシリコンによるAI推論の高速化
Taalasは、モデル固有のハードウェア設計を用いて世界最速かつ低コストなAI推論を実現するHC1プラットフォームを発表しました。Llama 3.1 8Bで毎秒17Kトークンを達成。

PostmarketOS 2026年2月アップデート:汎用カーネルとAIポリシー
PostmarketOSは現在、汎用カーネルパッケージ(linux-postmarketos-mainline、-stable、-lts)を提供し、生成AIを明示的に禁止するAIポリシーを更新しました。プロジェクトではコントリビューターの変更やハードウェアCIの改善も行われました。