Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent

✍️ OpenClawRadar📅 Publié: March 17, 2026🔗 Source
Modèle de Chat Qwen 3.5 Publié avec 21 Corrections de Bugs pour les Flux de Travail d'Agent
Ad

Un développeur a publié un modèle de chat corrigé pour les modèles Qwen 3.5, résolvant 21 bogues rencontrés lors des flux de travail agentiques. Il s'agit d'un remplacement direct du modèle officiel, nécessitant uniquement le remplacement du fichier chat_template.jinja.

Corrections clés

Le développeur a spécifiquement exécuté Qwen 3.5 35B pour des flux de travail agentiques et a résolu les problèmes majeurs suivants :

  • Plantage lors des appels d'outils : Correction d'un plantage lié à arguments | items (référencé comme discussion HF #4).
  • Fuites des blocs Outil/Réflexion : Le contenu de <tool_call> ne fuit plus dans les blocs <think>, avec désactivation automatique de la réflexion lorsque les outils sont actifs.
  • Appels d'outils parallèles : Les appels sont maintenant correctement séparés par des délimiteurs \n\n.
  • Boucles d'agents profondes : Empêche les plantages après 5+ sauts d'outils.
  • Gestion des rôles inconnus : Les rôles comme 'planner' et 'critic' basculent maintenant gracieusement au lieu de provoquer un plantage.
  • Analyseurs en flux continu : Fournit des limites XML propres pour le streaming.
  • Troncation configurable : Permet de définir une limite maximale de caractères pour les arguments d'outils volumineux et les réponses.
  • Prise en charge des rôles développeur : Ajoute la prise en charge des rôles comme 'Claude Code', 'Codex' et 'OpenCode'.

Une liste complète des 21 corrections est disponible dans le README du projet.

Ad

Configuration

Le modèle inclut des variables configurables. Elles peuvent être définies via des arguments en ligne de commande :

--chat-template-kwargs '{"enable_thinking":true,"auto_disable_thinking_with_tools":true,"max_tool_response_chars":8192}'

Compatibilité et tests

Le modèle a été testé sur les plateformes suivantes avec les versions minimales spécifiées :

  • llama.cpp (b4242+)
  • Open WebUI (v0.4.8+)
  • vLLM (v0.6.4+)
  • Ollama (v0.5.0+)
  • LM Studio (v0.3.5+)
  • Text Generation WebUI

Il est compatible avec tous les modèles Qwen 3.5 (35B, 27B, 14B, 9B, 4B et la série Coder) et est rétrocompatible avec Qwen3 32B.

Source et licence

Le modèle est disponible en téléchargement sur HuggingFace à barubary/qwen3.5-barubary-attuned-chat-template. Il est publié sous licence Apache 2.0, et le développeur accueille les retours et les rapports de bogues.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

🦀
Tools

OpenClaw sur Android : un ordinateur IA privé de la taille d'un pouce exécute OpenClaw dans une machine virtuelle

Le PlugClaw de Trustkernel est une clé USB de la taille d'un pouce qui exécute Android et OpenClaw dans une VM dédiée, ajoutant un agent GUI pour interagir avec les applications Android sur n'importe quel téléphone ou ordinateur portable.

OpenClawRadar
Passerelle de Contexte : Un Proxy Open-Source pour Compresser le Contexte des Agents IA
Tools

Passerelle de Contexte : Un Proxy Open-Source pour Compresser le Contexte des Agents IA

Context Gateway est un proxy open-source qui se place entre les agents de codage et les LLM, compressant les sorties d'outils avant qu'elles n'entrent dans la fenêtre de contexte. Il utilise de petits modèles de langage pour détecter le signal dans le contexte, effectue une compaction en arrière-plan à 85% de la capacité de la fenêtre, et inclut des plafonds de dépenses, un tableau de bord et des notifications Slack.

OpenClawRadar
Hermes Agent v0.6.0 propose une meilleure prise en charge des modèles locaux avec des analyseurs d'appels d'outils par modèle.
Tools

Hermes Agent v0.6.0 propose une meilleure prise en charge des modèles locaux avec des analyseurs d'appels d'outils par modèle.

Hermes Agent v0.6.0 de Nous Research fournit des analyseurs d'appels d'outils par modèle qui gèrent correctement les appels d'outils sur les modèles de classe 30B, prend en charge Ollama, vLLM et sglang nativement, et inclut six backends terminaux dont Modal et Daytona pour le déploiement serverless.

OpenClawRadar
SkillMesh : Routeur compatible MCP pour les grands catalogues d'outils réduit la taille du contexte de 70 %
Tools

SkillMesh : Routeur compatible MCP pour les grands catalogues d'outils réduit la taille du contexte de 70 %

SkillMesh est un routeur compatible MCP qui récupère uniquement les cartes d'expert pertinentes pour les requêtes des agents IA, réduisant la taille du contexte de 70 % et améliorant la sélection d'outils. Il prend en charge Claude via un serveur MCP, des bundles de compétences Codex et des schémas de fonction de style OpenAI.

OpenClawRadar