Opus 5.5 reasoning_extraction recusas: o gatilho é frequentemente uma palavra no seu próprio prompt ou esquema de ferramentas

✍️ OpenClawRadar📅 Publicado: October 1, 2026🔗 Source
Ad

Se os seus agentes no Opus 5.5 (e também Opus 5 e Fable 5.1) às vezes param com stop_reason: "refusal" e categoria reasoning_extraction, o gatilho geralmente está na sua própria configuração — não na mensagem do usuário. O guia de prompting e a página de refusals da Anthropic descrevem a categoria como cobrindo pedidos que "empurram o modelo a reproduzir seu raciocínio interno no texto da resposta". A correção documentada por eles é remover instruções do tipo "escreva seu raciocínio" e ler o pensamento resumido via display: "summarized".

O que a documentação e o billing te dizem

  • O fallback do lado do servidor não faz retry nessa categoria — a refusal volta para você.
  • Uma refusal que chega antes de qualquer output é cobrada nessa categoria (o mesmo vale para bio e frontier_llm).

A evidência mais útil: FaultMaven #1751

Eles fizeram uma bisseção de um schema de ferramenta. Uma única propriedade string chamada internal_reasoning bastou para disparar uma refusal no opus-5-5, fable-5-1 e opus-5 — enquanto opus-4-8 e sonnet-5 aceitaram a requisição idêntica. Renomear a propriedade para evidence_trail e remover a palavra "reasoning" das descrições resolveu. O nome do campo e a forma como você descreve o que quer importam, não o que o modelo de fato escreveria.

Ad

Outros gatilhos relatados

  • Um prompt de LLM-juiz no playbook da sublang recusou em toda chamada de adjudicação.
  • Um simples git commit no Claude Code (#97001).
  • Uma atualização de CHANGELOG, relatada no r/ClaudeCode.
  • A própria configuração OpenClaw do autor do post: duas refusals no Opus 5 (19 e 20 de setembro), ambas em conversas sobre o próprio texto pré-resposta do agente aparecendo no chat — sem instrução explícita de "reasoning", só falando sobre isso.

Por que uma cadeia de fallback importa

No caso do autor, a primeira refusal foi capturada pelo fallback de modelo do OpenClaw e respondida pelo Sonnet 5. Essa é a lição prática: o fallback do gateway faz retry onde o fallback do lado do servidor da Anthropic não faz. Um agente cuja cadeia de fallback é só Opus 5.x / Fable simplesmente falha.

Onde fazer grep no workspace

  • AGENTS.md e SOUL.md
  • Skills
  • Prompts de cron e heartbeat
  • Prompts de compactação ou resumo
  • Qualquer formato de saída JSON com um campo como "reasoning" ou "thought_process"

Candidatos óbvios no texto: "explain your reasoning", "show your thinking step by step", "include your chain of thought".

A pergunta em aberto da thread: alguém já viu isso disparar em um prompt sem nada desse tipo de wording? Isso diria mais sobre o quão amplo o classificador realmente é.

📖 Leia a fonte completa: r/openclaw

Ad

👀 See Also

Desenvolvedor Busca Conselhos de Arquitetura para Servir Modelos de Embed, Rerank e Zero-Shot em 8GB de VRAM
News

Desenvolvedor Busca Conselhos de Arquitetura para Servir Modelos de Embed, Rerank e Zero-Shot em 8GB de VRAM

Um desenvolvedor que está construindo um serviço unificado de Grafo de Conhecimento/RAG para um agente de codificação local está enfrentando limitações de memória em 8GB de VRAM e 16GB de RAM do sistema, experimentando erros de OOM, picos de latência e encerramentos pelo kernel do Linux ao servir três modelos de transformadores simultaneamente.

OpenClawRadar
Anthropic dobra limites de taxa do Claude Code e fecha acordo de computação com a SpaceX
News

Anthropic dobra limites de taxa do Claude Code e fecha acordo de computação com a SpaceX

Os limites de taxa de cinco horas do Claude Code foram dobrados para os planos Pro/Max/Team/Enterprise, as reduções de horário de pico foram removidas e os limites de taxa da API foram aumentados para modelos Opus. O Colossus 1 da SpaceX adiciona mais de 300 MW de capacidade (220 mil GPUs NVIDIA) em um mês.

OpenClawRadar
OpenClaw 2026.4.29 Quebrado – Faça o downgrade para 2026.2.6
News

OpenClaw 2026.4.29 Quebrado – Faça o downgrade para 2026.2.6

OpenClaw versão 2026.4.29 está quebrada com erros aleatórios, CLI lenta, respostas duplicadas. Faça downgrade para 2026.2.6 para corrigir.

OpenClawRadar
Apple constrói nova arquitetura de IA sobre os modelos fundacionais Google Gemini
News

Apple constrói nova arquitetura de IA sobre os modelos fundacionais Google Gemini

A Apple anunciou uma grande reformulação do Apple Intelligence, construída sobre modelos de base codesenvolvidos com o Google usando tecnologia Gemini. A nova arquitetura inclui um orquestrador, modelos no dispositivo e no servidor, e capacidades multimodais.

OpenClawRadar