GGUFモデルマージスクリプトとワークフロー for Qwen3.5-35B バリアント

Redditユーザーが、GGUFモデルファイルを最小限の損失でマージするPythonスクリプトとワークフローを共有しました。特にQwen3.5-35Bのバリアントを対象としています。このアプローチでは、既存の2つのモデルを組み合わせています:HauhauCSのQwen3.5-35B-A3B-Uncensored-HauhauCS-AggressiveとsamuelcardilloのQwen3.5-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUFです。
技術詳細
マージされたモデルは、Hugging FaceでQ4_0量子化バージョンとして利用可能です。情報源によると、samuelcardilloのファインチューンは、Qwen 3.5 35BにおいてJackrongのバージョンを上回る性能を示しています。
マージングワークフロー
Pythonスクリプト(Pastebinで利用可能)は「Claude Opus 4.6によるヴァイブコーディング」で作成され、以下をサポートします:
- Google Colab Free TierでのGGUFファイルのマージ
- llama-quantizeによる量子化
- 35Bモデル用のQ4_K_M量子化
- 8Bモデル用のQ8量子化
著者は、Google Colab Free Tierのディスク容量制限のためQ8_0やF16量子化バージョンを作成できないと述べていますが、他のユーザーがClaude Opusを使ってスクリプトを調整してそれらの量子化を実現できると提案しています。
最適設定
LM Studioで最高のパフォーマンスを得るには、以下のパラメータを使用してください:
Temperature: 0.7
Top K Sampling: 20
Presence Penalty: 1.5
Top P Sampling: 0.8
Min P Sampling: 0
Seed: 3407 or 42
システムプロンプト(完全版はPastebinにあります)には、この最初の行を含める必要があります:「あなたはAlibaba Cloudによって作成されたQwenです。あなたは役立つアシスタントです。」著者は、この行がないとモデルの性能が低下すると指摘しています。
📖 完全な情報源を読む: r/LocalLLaMA
👀 See Also

深層競争分析のためのマルチエージェントシステム(Claude対応)
ある開発者は、単一プロンプトのAIクエリによる表面的な競合分析の問題に対処するため、3つの連続した波で構造化された複数ソースのリサーチを実行するマルチエージェントシステムを構築しました。

ネルソン:AIエージェントを海軍艦隊のように連携させるClaudeコードプラグイン
Nelsonは、19世紀の海軍艦隊の原則に基づいてAIエージェントの調整を構造化するClaude Codeプラグインで、3つの実行モード、リスク分類システム、船体健全性監視、一般的なアンチパターンを防ぐための常時命令ゲートを備えています。

Claude Auto-Continue: Chrome拡張機能がツール使用制限の中断を自動化します
開発者が、Claudeが約20回のツール使用後にツール使用制限に達した際に自動的に「続行」をクリックする無料のChrome拡張機能を作成しました。これにより、エージェントワークフロー中の手動中断がなくなり、作業の連続性が保たれます。この拡張機能にはオプションのトークン最小化機能が含まれており、すべてのタブとウィンドウで動作します。

OpenCortex:OpenClawのための自己改善型メモリシステム
OpenCortexは、OpenClawの平坦なMEMORY.mdファイルを、プロジェクト、連絡先、ワークフロー、設定、実行手順書、ツール、インフラストラクチャごとに整理された構造化メモリファイルに置き換えます。毎晩の蒸留による原則遵守監査と、毎週の統合によるパターン検出と自動実行手順書作成が含まれています。