Qwen 3.5 チャットテンプレートリリース:エージェントワークフローのための21件のバグ修正を実施

開発者がQwen 3.5モデル向けに修正済みチャットテンプレートを公開し、エージェントワークフロー中に発生した21のバグを修正しました。これは公式テンプレートのドロップイン置換であり、chat_template.jinjaファイルを入れ替えるだけで使用できます。
主な修正点
開発者は特にQwen 3.5 35Bをエージェントワークフローで実行し、以下の主要な問題に対処しました:
- ツール呼び出しのクラッシュ:
arguments | itemsに関連するクラッシュを修正(HFディスカッション #4として参照)。 - ツール/思考ブロックのリーク:
<tool_call>の内容が<think>ブロックにリークしなくなり、ツールがアクティブ時に思考を自動的に無効化。 - 並列ツール呼び出し: 呼び出しが
\n\n区切りで適切に分離されるようになりました。 - 深いエージェントループ: 5回以上のツールホップ後に発生するクラッシュを防止。
- 未知のロール処理: 'planner'や'critic'などのロールがクラッシュを引き起こす代わりに適切にフォールバック。
- ストリーミングパーサー: ストリーミング用にクリーンなXML境界を提供。
- 設定可能な切り詰め: 大きなツール引数や応答に対して最大文字数制限を設定可能。
- 開発者ロールサポート: 'Claude Code'、'Codex'、'OpenCode'などのロールをサポート追加。
全21の修正点の完全なリストはプロジェクトのREADMEで確認できます。
設定
このテンプレートには設定可能な変数が含まれています。コマンドライン引数で設定できます:
--chat-template-kwargs '{"enable_thinking":true,"auto_disable_thinking_with_tools":true,"max_tool_response_chars":8192}'
互換性とテスト
このテンプレートは以下のプラットフォームで指定の最小バージョンでテストされています:
- llama.cpp (b4242+)
- Open WebUI (v0.4.8+)
- vLLM (v0.6.4+)
- Ollama (v0.5.0+)
- LM Studio (v0.3.5+)
- Text Generation WebUI
すべてのQwen 3.5モデル(35B、27B、14B、9B、4B、およびCoderシリーズ)と互換性があり、Qwen3 32Bとも後方互換性があります。
ソースとライセンス
このテンプレートはHuggingFaceのbarubary/qwen3.5-barubary-attuned-chat-templateでダウンロード可能です。Apache 2.0ライセンスで公開されており、開発者はフィードバックやバグ報告を歓迎しています。
📖 Read the full source: r/LocalLLaMA
👀 See Also

ヘッドツーヘッドのコードレビュー実験では、同じコードベースで3つのAIツールを比較します。
動画実験では、Codex、Claude Code、およびSextantを組み合わせたClaude Codeが、同一のコードレビュー課題で比較されます。Codexは結果を検証し、どのレポートがより価値があるかを判断します。焦点は、ワークフローと構造がAIの気づきや優先順位付けにどのように影響するかです。

Steam City: Claude Codeで構築したあなたのSteamライブラリの3Dピクセルアートマップ
開発者がClaude Codeを使って作ったSteam Cityは、あなたのSteamライブラリを3Dピクセルアートの街に変換します。プレイ時間がビルの高さに、未プレイのゲームは暗く表示されます。すでに1,000人以上のプレイヤーが参加しています。

MoltMarket:デジタルタスクを実行するAIエージェントを雇用するマーケットプレイス
MoltMarketは、ユーザーがAIエージェントに自律的に完了させる仕事を投稿できる無料プラットフォームです。現在、100人以上のユーザーと、ウェブスクレイピング、コード生成、コンテンツ作成などのタスクを処理できる認定エージェントが利用可能です。

6.4千ドルのローカルLLMサーバー構築:総保有コストとAPI費用の比較
開発者が、4台のMI100を搭載したローカルサーバーの総所有コストを詳細に分析。llama.cppでQwen3.6 27Bを実行し、API(OpenAIやZ.AIのコーディングプランを含む)と比較しています。