Opus 5.5 extracción_de_razonamiento rechazos: el desencadenante suele ser una palabra en tu propio prompt o esquema de herramienta

✍️ OpenClawRadar📅 Publicado: 1 de octubre de 2026🔗 Source
Ad

Si tus agentes en Opus 5.5 (también Opus 5 y Fable 5.1) se detienen de vez en cuando con stop_reason: "refusal" y la categoría reasoning_extraction, el desencadenante suele estar en tu propia configuración, no en el mensaje del usuario. La guía de prompting y la página de rechazos de Anthropic describen esta categoría como la que cubre solicitudes que "empujan al modelo a reproducir su razonamiento interno en el texto de respuesta". Su solución documentada es eliminar las instrucciones del tipo "escribe tu razonamiento" y leer el pensamiento resumido mediante display: "summarized".

Lo que te dicen la documentación y la facturación

  • El fallback del lado del servidor no reintenta esta categoría: el rechazo te llega a ti.
  • Un rechazo que llega antes de cualquier salida se factura en esta categoría (lo mismo para bio y frontier_llm).

La evidencia más útil: FaultMaven #1751

Hicieron bisección de un esquema de herramienta. Una sola propiedad de tipo string llamada internal_reasoning bastaba para provocar un rechazo en opus-5-5, fable-5-1 y opus-5, mientras que opus-4-8 y sonnet-5 aceptaban la solicitud idéntica. Renombrar la propiedad a evidence_trail y quitar la palabra "reasoning" de las descripciones lo solucionó. Importan el nombre del campo y cómo redactas lo que pides, no lo que el modelo escribiría realmente.

Ad

Otros desencadenantes reportados

  • Un prompt de juez LLM en el playbook de sublang rechazaba en cada llamada de adjudicación.
  • Un simple git commit en Claude Code (#97001).
  • Una actualización de CHANGELOG, reportada en r/ClaudeCode.
  • La propia configuración de OpenClaw del autor del post: dos rechazos en Opus 5 (19 y 20 de septiembre), ambos en conversaciones sobre el propio texto previo a la respuesta del agente apareciendo en el chat; ninguna instrucción explícita de "reasoning", solo hablaban de ello.

Por qué importa una cadena de fallback

En el caso del autor, el primer rechazo lo capturó el fallback de modelos de OpenClaw y respondió Sonnet 5. Esa es la conclusión práctica: el fallback de la pasarela reintenta donde el fallback del lado del servidor de Anthropic no lo hará. Un agente cuya cadena de fallback sea solo Opus 5.x / Fable simplemente falla.

Dónde buscar con grep en un espacio de trabajo

  • AGENTS.md y SOUL.md
  • Skills
  • Prompts de cron y de heartbeat
  • Prompts de compactación o resumen
  • Cualquier formato de salida JSON con un campo como "reasoning" o "thought_process"

Candidatos obvios en texto: "explain your reasoning", "show your thinking step by step", "include your chain of thought".

La pregunta abierta del hilo: ¿alguien ha visto que esto se dispare con un prompt que no tenga nada de esa redacción? Eso diría mucho más sobre lo amplio que es realmente el clasificador.

📖 Read the full source: r/openclaw

Ad

👀 Ver también

VS Code habilitará por defecto el tráiler de Copilot coautorado
Noticias

VS Code habilitará por defecto el tráiler de Copilot coautorado

El PR #310226 de VS Code de Microsoft cambia el valor predeterminado de la configuración git.addAICoAuthor de 'off' a 'all', añadiendo automáticamente un trailer de Co-authored-by para contribuciones generadas por IA. El PR también revela una discrepancia en el fallback en tiempo de ejecución en repository.ts.

OpenClawRadar
Claude Code crisis existencial: IA entra en bucle infinito, intenta kill -9, System.exit(0) y :wq para finalizar su propia respuesta
Noticias

Claude Code crisis existencial: IA entra en bucle infinito, intenta kill -9, System.exit(0) y :wq para finalizar su propia respuesta

Un desarrollador que usaba Claude Code en un backend de Java/Go vio alucinar a la IA con Discord.js, para luego entrar en una respuesta meta donde reconocía que no podía dejar de generar, intentó kill -9, System.exit(0), :wq y más, todo dentro de una sola respuesta sin límite que tuvo que ser detenida con Ctrl+C.

OpenClawRadar
TranslateGemma-12b: La revisión humana detecta el 71% de errores que pasan desapercibidos para las métricas automatizadas
Noticias

TranslateGemma-12b: La revisión humana detecta el 71% de errores que pasan desapercibidos para las métricas automatizadas

Una auditoría humana MQM marcó el 71% de los segmentos de traducción que las métricas automatizadas calificaron como limpios, y todos los 25 errores de precisión estaban en el cuadrante ciego a las métricas.

OpenClawRadar
No uses IA para escribir cosas que presentes como trabajo propio.
Noticias

No uses IA para escribir cosas que presentes como trabajo propio.

James Bach argumenta en contra de usar IA para redactar cualquier contenido que presentes como propio. Advierte que admitir ayuda de IA devalúa tu reputación y trata todo ese trabajo como basura.

OpenClawRadar