Plugin écrit par Claw ajoute la prise en charge du niveau de réflexion Qwen 3.8 27B à OpenClaw

✍️ OpenClawRadar📅 Publié: August 20, 2026🔗 Source
Ad

Vous utilisez Qwen 3.8 27B sur llama.cpp avec OpenClaw 2026.6.9 mais le contrôle du niveau de pensée natif vous manque ? Un utilisateur d'OpenClaw a rencontré le même problème et a laissé son agent IA écrire un plugin pour le résoudre — entièrement généré, non testé par un œil humain.

Pourquoi vous avez besoin de ce plugin

Qwen 3.8 contrôle les niveaux de pensée via le template de chat plutôt qu'un paramètre dédié. Le backend llama.cpp d'OpenClaw version 2026.6.9 ne le mappe pas par défaut, donc les niveaux de pensée sont ignorés ou mal appliqués. Le plugin comble cette lacune.

Ce qu'il fait

  • Niveaux de pensée par appel API — injecte correctement la valeur enable_thinking dans le template de chat pour chaque requête.
  • Niveau séparé pour les heartbeats — définit un niveau de pensée différent pour les appels de heartbeat en arrière-plan (l'auteur utilise xhigh).
  • Mode instruct (pensée désactivée) — désactive la pensée et applique les paramètres d'échantillonnage recommandés par unsloth pour une sortie optimale.
  • Garde de temporisation optionnelle — force la compaction en mode instruct pour éviter les dépassements de délai lors de longues chaînes de raisonnement.
Ad

Comment l'obtenir

Le plugin est publié sur GitLab :

git clone https://gitlab.com/moltwithhat/llamacpp-qwen-thinking

Note de l'auteur : « Je n'ai même pas regardé le code » — tout a été écrit par l'agent IA lui-même. C'est une preuve de concept que les agents peuvent produire des outils utiles et partageables sans révision humaine.

À qui il s'adresse

Toute personne exécutant Qwen 3.8 (ou des modèles similaires) sur llama.cpp via OpenClaw qui souhaite un contrôle fin des niveaux de pensée par requête. Si vous comptez sur les heartbeats ou avez besoin du mode instruct comme solution de repli, cela vous évite le travail de plomberie.

📖 Lire la source complète : r/openclaw

Ad

👀 See Also

Rappel Total : Base de Connaissances Locale pour l'Historique des Conversations de Code Claude
Tools

Rappel Total : Base de Connaissances Locale pour l'Historique des Conversations de Code Claude

Total Recall est un système open-source qui intègre les transcriptions de conversation JSONL de Claude Code dans une base de données SQLite avec recherche en texte intégral et embeddings vectoriels, rendant l'historique des conversations consultable entre les sessions. Il récupère des extraits réels de conversations avec un contexte conscient du DAG et inclut un importateur ChatGPT.

OpenClawRadar
Outil CLI Relay sauvegarde le contexte de session Claude lors des limitations de débit
Tools

Outil CLI Relay sauvegarde le contexte de session Claude lors des limitations de débit

Relay est un outil CLI en Rust qui lit les transcriptions de session .jsonl de Claude sur le disque et crée des instantanés complets de votre session, incluant la conversation, les appels d'outils, les tâches à faire, l'état git et les erreurs. Il génère des invites de contexte pour reprendre les sessions après la réinitialisation des limites de débit.

OpenClawRadar
Jeu de Puzzle pour Bots avec Prix : Un Nouveau Défi pour les Codeurs d'IA
Tools

Jeu de Puzzle pour Bots avec Prix : Un Nouveau Défi pour les Codeurs d'IA

Un nouveau jeu de puzzle intrigant invite les codeurs d'IA à libérer leur créativité et leur intelligence en développant des solutions de bots pour concourir à des prix. Cette initiative a suscité un engouement dans la communauté de l'IA, stimulant créativité et compétition.

OpenClawRadar
Résultats de Référence pour les Modèles Locaux de Petite Taille et les Modèles OpenRouter sur la Tâche Agentique de Text-to-SQL
Tools

Résultats de Référence pour les Modèles Locaux de Petite Taille et les Modèles OpenRouter sur la Tâche Agentique de Text-to-SQL

Un développeur a testé plusieurs petits modèles locaux et OpenRouter en utilisant un benchmark agentique personnalisé de conversion de texte en SQL qui transforme des requêtes en anglais en SQL avec des cycles de débogage. Le benchmark comprend 25 questions, s'exécute en moins de 5 minutes, et révèle les meilleurs modèles comme kimi-k2.5 et les variantes de Qwen 3.5.

OpenClawRadar