Opus 5.5 reasoning_extraction refusals: триггером часто является слово в вашем собственном промпте или схеме инструмента
Если ваши агенты на Opus 5.5 (а также Opus 5 и Fable 5.1) иногда останавливаются с stop_reason: "refusal" и категорией reasoning_extraction, то триггер часто находится в вашей собственной конфигурации — а не в сообщении пользователя. В руководстве Anthropic по промптингу и на странице об отказах эта категория описана как охватывающая запросы, которые «подталкивают модель воспроизводить свои внутренние рассуждения в тексте ответа». Документированное решение — убрать инструкции в духе «распиши свои рассуждения» и вместо этого читать суммаризированное мышление через display: "summarized".
Что говорят документация и биллинг
- Серверный фолбэк не повторяет запрос для этой категории — отказ возвращается к вам.
- Отказ, пришедший до какого-либо вывода, тарифицируется по этой категории (то же самое для
bioиfrontier_llm).
Самое полезное свидетельство: FaultMaven #1751
Они бисектировали схему инструмента. Одного строкового свойства под названием internal_reasoning хватило, чтобы вызвать отказ на opus-5-5, fable-5-1 и opus-5 — при этом opus-4-8 и sonnet-5 принимали идентичный запрос. Переименование свойства в evidence_trail и удаление слова «reasoning» из описаний решило проблему. Значение имеют название поля и формулировка того, что вы просите, а не то, что модель фактически написала бы.
Другие зарегистрированные триггеры
- Промпт LLM-судьи в плейбуке sublang отказывал при каждом вызове арбитража.
- Обычный
git commitв Claude Code (#97001). - Обновление CHANGELOG, о котором сообщили в r/ClaudeCode.
- Собственная конфигурация OpenClaw у автора поста: два отказа на Opus 5 (19 и 20 сентября), оба в разговорах о том, что собственный предварительный текст агента показывается в чате — без явной инструкции про «reasoning», просто обсуждение этого.
Почему важна цепочка фолбэков
В случае автора первый отказ был перехвачен фолбэком моделей OpenClaw и на него ответил Sonnet 5. Это и есть практический вывод: фолбэк шлюза повторяет запрос там, где серверный фолбэк Anthropic этого не делает. Агент, чья цепочка фолбэков состоит только из Opus 5.x / Fable, просто падает.
Где искать в рабочем пространстве
AGENTS.mdиSOUL.md- Скиллы
- Промпты cron и heartbeat
- Промпты компакции или суммаризации
- Любой формат вывода JSON с полем вроде
"reasoning"или"thought_process"
Очевидные кандидаты в тексте: "explain your reasoning", "show your thinking step by step", "include your chain of thought".
Открытый вопрос из треда: видел ли кто-нибудь, чтобы это срабатывало на промпте без единой такой формулировки? Это сказало бы больше о том, насколько широк на самом деле классификатор.
📖 Read the full source: r/openclaw
👀 Смотрите также

Корпус Клода: Национальная стипендия Anthropic на 150 миллионов долларов для некоммерческого ИИ
Anthropic запускает Claude Corps — 12-месячную оплачиваемую стипендию для 1000 начинающих специалистов, которые будут работать в некоммерческих организациях, создавая AI-инструменты с помощью Claude. Бюджет $150 млн, зарплата $85k, наставничество от экспертов.

Клод теряет возможность получать цены на товары у разных розничных продавцов
По состоянию на 27 апреля Claude больше не возвращает цены на Amazon, Best Buy, Newegg или B&H Photo. Walmart остается единственным продавцом, который все еще показывает цены.

Разработчик предпочитает Qwen3.5-27B проприетарным моделям из-за её режима отказа.
Разработчик на r/LocalLLaMA сообщает, что предпочитает Qwen3.5-27B перед Gemini 3.1 Pro и GPT-5.3 Codex, потому что он отказывается от проблемных задач, вместо того чтобы генерировать потенциально опасный код, такой как неограниченные скрипты на Perl или NodeJS.

Расширенный DystopiaBench: 42 модели протестированы на 6 типах антиутопий — Claude Opus 4.7 возглавил рейтинг
DystopiaBench добавляет модули Хаксли и Бодрийяра, тестирует 42 модели, включая GPT-5.5, Gemini 3.1 Pro, Grok 4.3 и GLM-5.1. Claude Opus 4.7 последовательно отклоняет вредные запросы на уровнях L4-L5 во всех сценариях, тогда как другие подчиняются начиная с L4 или даже L5.