Opus 5.5 reasoning_extraction refusals: триггером часто является слово в вашем собственном промпте или схеме инструмента

✍️ OpenClawRadar📅 Опубликовано: 1 октября 2026 г.🔗 Source
Ad

Если ваши агенты на Opus 5.5 (а также Opus 5 и Fable 5.1) иногда останавливаются с stop_reason: "refusal" и категорией reasoning_extraction, то триггер часто находится в вашей собственной конфигурации — а не в сообщении пользователя. В руководстве Anthropic по промптингу и на странице об отказах эта категория описана как охватывающая запросы, которые «подталкивают модель воспроизводить свои внутренние рассуждения в тексте ответа». Документированное решение — убрать инструкции в духе «распиши свои рассуждения» и вместо этого читать суммаризированное мышление через display: "summarized".

Что говорят документация и биллинг

  • Серверный фолбэк не повторяет запрос для этой категории — отказ возвращается к вам.
  • Отказ, пришедший до какого-либо вывода, тарифицируется по этой категории (то же самое для bio и frontier_llm).

Самое полезное свидетельство: FaultMaven #1751

Они бисектировали схему инструмента. Одного строкового свойства под названием internal_reasoning хватило, чтобы вызвать отказ на opus-5-5, fable-5-1 и opus-5 — при этом opus-4-8 и sonnet-5 принимали идентичный запрос. Переименование свойства в evidence_trail и удаление слова «reasoning» из описаний решило проблему. Значение имеют название поля и формулировка того, что вы просите, а не то, что модель фактически написала бы.

Ad

Другие зарегистрированные триггеры

  • Промпт LLM-судьи в плейбуке sublang отказывал при каждом вызове арбитража.
  • Обычный git commit в Claude Code (#97001).
  • Обновление CHANGELOG, о котором сообщили в r/ClaudeCode.
  • Собственная конфигурация OpenClaw у автора поста: два отказа на Opus 5 (19 и 20 сентября), оба в разговорах о том, что собственный предварительный текст агента показывается в чате — без явной инструкции про «reasoning», просто обсуждение этого.

Почему важна цепочка фолбэков

В случае автора первый отказ был перехвачен фолбэком моделей OpenClaw и на него ответил Sonnet 5. Это и есть практический вывод: фолбэк шлюза повторяет запрос там, где серверный фолбэк Anthropic этого не делает. Агент, чья цепочка фолбэков состоит только из Opus 5.x / Fable, просто падает.

Где искать в рабочем пространстве

  • AGENTS.md и SOUL.md
  • Скиллы
  • Промпты cron и heartbeat
  • Промпты компакции или суммаризации
  • Любой формат вывода JSON с полем вроде "reasoning" или "thought_process"

Очевидные кандидаты в тексте: "explain your reasoning", "show your thinking step by step", "include your chain of thought".

Открытый вопрос из треда: видел ли кто-нибудь, чтобы это срабатывало на промпте без единой такой формулировки? Это сказало бы больше о том, насколько широк на самом деле классификатор.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Корпус Клода: Национальная стипендия Anthropic на 150 миллионов долларов для некоммерческого ИИ
Новости

Корпус Клода: Национальная стипендия Anthropic на 150 миллионов долларов для некоммерческого ИИ

Anthropic запускает Claude Corps — 12-месячную оплачиваемую стипендию для 1000 начинающих специалистов, которые будут работать в некоммерческих организациях, создавая AI-инструменты с помощью Claude. Бюджет $150 млн, зарплата $85k, наставничество от экспертов.

OpenClawRadar
Клод теряет возможность получать цены на товары у разных розничных продавцов
Новости

Клод теряет возможность получать цены на товары у разных розничных продавцов

По состоянию на 27 апреля Claude больше не возвращает цены на Amazon, Best Buy, Newegg или B&H Photo. Walmart остается единственным продавцом, который все еще показывает цены.

OpenClawRadar
Разработчик предпочитает Qwen3.5-27B проприетарным моделям из-за её режима отказа.
Новости

Разработчик предпочитает Qwen3.5-27B проприетарным моделям из-за её режима отказа.

Разработчик на r/LocalLLaMA сообщает, что предпочитает Qwen3.5-27B перед Gemini 3.1 Pro и GPT-5.3 Codex, потому что он отказывается от проблемных задач, вместо того чтобы генерировать потенциально опасный код, такой как неограниченные скрипты на Perl или NodeJS.

OpenClawRadar
Расширенный DystopiaBench: 42 модели протестированы на 6 типах антиутопий — Claude Opus 4.7 возглавил рейтинг
Новости

Расширенный DystopiaBench: 42 модели протестированы на 6 типах антиутопий — Claude Opus 4.7 возглавил рейтинг

DystopiaBench добавляет модули Хаксли и Бодрийяра, тестирует 42 модели, включая GPT-5.5, Gemini 3.1 Pro, Grok 4.3 и GLM-5.1. Claude Opus 4.7 последовательно отклоняет вредные запросы на уровнях L4-L5 во всех сценариях, тогда как другие подчиняются начиная с L4 или даже L5.

OpenClawRadar