Opus 5.5 refus d'extraction de raisonnement : le déclencheur est souvent un mot dans votre propre prompt ou schéma d'outil

✍️ OpenClawRadar📅 Publié: October 1, 2026🔗 Source
Ad

Si vos agents sur Opus 5.5 (ainsi que Opus 5 et Fable 5.1) s'arrêtent parfois avec stop_reason: "refusal" et la catégorie reasoning_extraction, le déclencheur se trouve souvent dans votre propre configuration — pas dans le message de l'utilisateur. Le guide de prompting et la page sur les refus d'Anthropic décrivent cette catégorie comme couvrant les requêtes qui « poussent le modèle à reproduire son raisonnement interne dans le texte de la réponse ». Leur correctif documenté consiste à supprimer les instructions du type « écris ton raisonnement » et à lire la pensée résumée via display: "summarized" à la place.

Ce que la doc et la facturation vous disent

  • Le fallback côté serveur ne réessaie pas cette catégorie — le refus vous est renvoyé.
  • Un refus qui survient avant toute sortie est facturé pour cette catégorie (idem pour bio et frontier_llm).

L'élément le plus parlant : FaultMaven #1751

Ils ont isolé un schéma d'outil par bissection. Une seule propriété de type string nommée internal_reasoning suffisait à déclencher un refus sur opus-5-5, fable-5-1 et opus-5 — alors que opus-4-8 et sonnet-5 acceptaient la requête identique. Renommer la propriété en evidence_trail et retirer le mot « reasoning » des descriptions a résolu le problème. Ce sont le nom du champ et la formulation de ce que vous demandez qui comptent, pas ce que le modèle écrirait réellement.

Ad

Autres déclencheurs signalés

  • Un prompt de juge LLM dans le playbook de sublang a échoué à chaque appel d'arbitrage.
  • Un simple git commit dans Claude Code (#97001).
  • Une mise à jour de CHANGELOG, rapportée sur r/ClaudeCode.
  • La configuration OpenClaw de l'auteur lui-même : deux refus sur Opus 5 (les 19 et 20 septembre), tous deux dans des conversations portant sur le texte de pré-réponse de l'agent qui apparaissait dans le chat — aucune instruction « reasoning » explicite, on en parlait simplement.

Pourquoi une chaîne de fallback compte

Dans le cas de l'auteur, le premier refus a été intercepté par le fallback de modèle d'OpenClaw et traité par Sonnet 5. C'est la conclusion pratique : le fallback de la passerelle réessaie là où le fallback côté serveur d'Anthropic ne le fera pas. Un agent dont la chaîne de fallback n'est composée que d'Opus 5.x / Fable échoue tout simplement.

Où grep dans un workspace

  • AGENTS.md et SOUL.md
  • Les Skills
  • Les prompts de cron et de heartbeat
  • Les prompts de compaction ou de résumé
  • Tout format de sortie JSON avec un champ du type "reasoning" ou "thought_process"

Candidats évidents dans le texte : "explain your reasoning", "show your thinking step by step", "include your chain of thought".

La question ouverte du fil : quelqu'un a-t-il vu cela se déclencher sur un prompt sans aucune de ces formulations ? Cela en dirait plus sur l'étendue réelle du classifieur.

📖 Read the full source: r/openclaw

Ad

👀 See Also

Mise à jour des performances d'inférence MLX : Benchmarks et fonctionnalités d'avril 2026
News

Mise à jour des performances d'inférence MLX : Benchmarks et fonctionnalités d'avril 2026

Les performances d'inférence MLX se sont considérablement améliorées, avec Qwen3.5-35B-A3B atteignant 71,8 tokens/seconde pour un contexte de 4K, et de nouvelles fonctionnalités comme la prédiction multi-token et le préremplissage spéculatif offrant des accélérations de 2,3x à 5,5x pour les grands modèles.

OpenClawRadar
Révélation de l'Assemblage et de la Structure du Prompt Système de Claude Code
News

Révélation de l'Assemblage et de la Structure du Prompt Système de Claude Code

Une fuite de source map dans le package npm de Claude Code a exposé le flux d'assemblage des prompts système, montrant des sections de préfixe statiques suivies de contenu dynamique spécifique à la session, avec trois variantes d'identité et des directives d'exécution détaillées.

OpenClawRadar
Claude Code s'attaque à la suppression du Big Kernel Lock de QNX, en commençant par les statistiques de contention de l'espace utilisateur
News

Claude Code s'attaque à la suppression du Big Kernel Lock de QNX, en commençant par les statistiques de contention de l'espace utilisateur

Un développeur a demandé à Claude Code de reconcevoir le micro-noyau de QNX pour supprimer le gros verrou noyau. Claude a estimé 3 mois pour un développeur humain de haut niveau, puis a commencé par concevoir des statistiques de verrouillage de type /proc et corriger les sous-systèmes du noyau un par un.

OpenClawRadar
🦀
News

Débat chez Debian sur la politique de contribution à l'IA/LLM : ce que les développeurs doivent savoir

Debian a commencé à voter sur l'avenir des contributions IA/LLM. Le résultat déterminera comment le code généré par IA sera traité dans les paquets Debian.

OpenClawRadar