Pantheon-Reasoning-27B:Grypheによる高密度推論RPモデル

GrypheがPantheon-Reasoning-27Bをリリースしました。これはllmfan46/Qwen3.6-27B-uncensored-heretic-v2-Native-MTP-Preservedをベースに、ロールプレイ向けにファインチューニングされた推論モデルです。このモデルは、キャラクターワークに構造化された推論をもたらすことを目的としており、トーンを調整し、ナラティブの展開を計画し、キャラクターが実際にどう反応するかを考慮した上でセリフを生成します。
トレーニングデータの構成(すべて完全な推論トレースを含む):
- Pantheonデータ(約28%)— コアとなるロールプレイコーパスに、バック生成された推論トレースを付与
- Opus-4.6-Reasoning-24k(約21%)— クリーニングされたClaude Opus 4.6の推論トレース(STEM、コーディング、指示追従用)
- WorldSimデータ(約16%)— Opus 4.6による長編ナラティブロールプレイ(ネイティブ推論付き、主に三人称現在形)
- テキストアドベンチャーデータ(約16%)— インタラクティブフィクションとテキストアドベンチャーコンテンツ(バック生成推論付き)
- 汎用ロールプレイデータ(約16%)— 多様なロールプレイのトランスクリプト(バック生成推論付き)
- Tiamatデータ(約3%)— Tiamat-24B-Magistralからのキャラクター/RPデータセット(マルチステップ改善パイプライン、各やりとりごとに推論をバック生成)
モデルはpreserve_thinking: trueで学習されており、マルチターン会話のすべてのアシスタント応答で思考タグが有効になります(最初の応答だけでなく)。
GGUF量子化モデルがローカル推論用に利用可能です。ベースモデルにQwen 3.6 27Bを選んだのは、拒否の低減と文章作成能力を意図したものです。GrypheはGemma 4 31Bも検討しましたが、アーキテクチャ上の問題から「訓練が非常に面倒」と述べています。
📖 出典全文: r/LocalLLaMA
👀 See Also

Claudeは、Pro、Max、Teamプランに追加の利用クレジットを提供します。
Claudeは、Pro、Max、Teamプランの加入者に対して、サブスクリプション料金と同額の一回限りの追加利用クレジットを提供しています。このクレジットは、Claude、Claude Code、Claude Cowork、およびサードパーティ製品で使用できます。
Opus 4.7、約500の指示に従うことが可能に、1年前の約150から増加
2026年5月に更新された研究により、Opus 4.7は約500の指示に確実に従うことができることが示されました。2025年7月時点では約150でした。GPT-5.5は約5000を処理します。CLAUDE.mdファイルのサイズへの影響について。

FPGA上のニューロモーフィック・イジングマシンが困難な組合せ問題を解決
FPGA上に実装されたニューロモルフィックイジングマシンが、量子トンネリング物理と脳に着想を得たアーキテクチャを用いて、タンパク質フォールディングのような組合せ最適化問題を解きます。

MLX推論パフォーマンスアップデート:2026年4月ベンチマークと機能
MLXの推論性能が大幅に向上し、Qwen3.5-35B-A3Bは4Kコンテキストで71.8トークン/秒を達成。Multi-Token PredictionやSpecPrefillなどの新機能により、大規模モデルで2.3倍から5.5倍の高速化を実現。