Opus 5.5 추론_추출 거부: 방아쇠는 종종 당신의 프롬프트나 도구 스키마에 있는 단어입니다

✍️ OpenClawRadar📅 게시일: October 1, 2026🔗 Source
Ad

Opus 5.5(그리고 Opus 5, Fable 5.1)를 사용하는 에이전트가 가끔 stop_reason: "refusal"과 reasoning_extraction 카테고리와 함께 멈춘다면, 그 원인은 대개 사용자 메시지가 아니라 여러분의 설정에 있습니다. Anthropic의 프롬프팅 가이드와 거부(refusals) 페이지는 이 카테고리를 모델이 "응답 텍스트에서 내부 추론을 재현하도록 유도하는" 요청을 포괄한다고 설명합니다. 문서에서 제시하는 해결책은 "추론을 작성하라"는 식의 지시를 제거하고, 대신 display: "summarized"로 요약된 사고 과정을 읽는 것입니다.

문서와 과금이 알려주는 것

  • 서버 측 폴백은 이 카테고리를 재시도하지 않습니다 — 거부 응답이 그대로 여러분에게 돌아옵니다.
  • 출력이 나오기 전에 도착한 거부는 이 카테고리로 과금됩니다(bio와 frontier_llm도 동일).

가장 유용한 증거: FaultMaven #1751

이들은 도구 스키마를 이분 탐색했습니다. internal_reasoning이라는 단일 문자열 속성 하나만으로도 opus-5-5, fable-5-1, opus-5에서 거부가 발생했습니다. 반면 opus-4-8과 sonnet-5는 동일한 요청을 그대로 받아들였습니다. 속성 이름을 evidence_trail로 바꾸고 설명에서 "reasoning"이라는 단어를 제거하자 해결되었습니다. 모델이 실제로 무엇을 작성할지가 아니라, 필드 이름과 여러분이 요청하는 내용의 표현이 문제입니다.

Ad

그 밖에 보고된 트리거

  • sublang의 플레이북에 있는 LLM 심사(judge) 프롬프트가 모든 판정 호출에서 거부되었습니다.
  • Claude Code에서의 평범한 git commit(#97001).
  • r/ClaudeCode에 보고된 CHANGELOG 업데이트.
  • 글쓴이 본인의 OpenClaw 설정: Opus 5에서 두 번의 거부(9월 19일과 20일)가 있었고, 둘 다 에이전트 자신의 사전 답변 텍스트가 채팅에 나타나는 것에 관한 대화 중이었습니다 — 명시적인 "reasoning" 지시는 없었고 그저 그것에 대해 논의했을 뿐입니다.

폴백 체인이 중요한 이유

글쓴이의 경우, 첫 번째 거부는 OpenClaw의 모델 폴백에 의해 포착되어 Sonnet 5가 답변했습니다. 이것이 실질적인 교훈입니다. Anthropic의 서버 측 폴백이 재시도하지 않는 곳에서 게이트웨이의 폴백은 재시도합니다. 폴백 체인이 Opus 5.x / Fable뿐인 에이전트는 그냥 실패합니다.

워크스페이스에서 grep할 위치

  • AGENTS.md와 SOUL.md
  • 스킬(Skills)
  • Cron 및 하트비트 프롬프트
  • 압축(compaction) 또는 요약 프롬프트
  • "reasoning" 또는 "thought_process" 같은 필드가 있는 모든 JSON 출력 형식

텍스트에서 명백한 후보: "explain your reasoning", "show your thinking step by step", "include your chain of thought".

스레드에서 남은 열린 질문: 이런 표현이 전혀 없는 프롬프트에서 이것이 발생하는 걸 본 사람이 있나요? 그렇다면 분류기가 실제로 얼마나 넓은지를 더 잘 말해줄 것입니다.

📖 전체 원문 읽기: r/openclaw

Ad

👀 See Also

OpenAI의 훈련 비용이 매년 Anthropic의 비용보다 4-5배 더 높을 것으로 예상됩니다
News

OpenAI의 훈련 비용이 매년 Anthropic의 비용보다 4-5배 더 높을 것으로 예상됩니다

월스트리트저널이 보도한 기밀 재무 자료에 따르면, OpenAI는 향후 5년 동안 매년 Anthropic보다 훈련에 4~5배 더 많은 비용을 지출할 것으로 예상됩니다. 이 비용 규모는 정말로 놀라운 수준으로 묘사됩니다.

OpenClawRadar
AI의 일탈 정상화: 왜 당신의 에이전트 시스템이 실패할 것인가
News

AI의 일탈 정상화: 왜 당신의 에이전트 시스템이 실패할 것인가

AI 업계는 챌린저호 참사와 유사한 문화적 실패를 반복하고 있습니다. 아직 나쁜 일이 발생하지 않았다는 이유로 신뢰할 수 없는 LLM 출력을 안전하다고 간주하는 것입니다. 에이전트가 하드 드라이브를 포맷하고, 데이터베이스를 삭제하며, GitHub 이슈를 생성한 실제 사례가 있습니다.

OpenClawRadar
클로드 코드 AFK 자동 계속: 잘못된 기능의 해부
News

클로드 코드 AFK 자동 계속: 잘못된 기능의 해부

2026년 7월, Anthropic은 Claude Code v2.1.198에 이스터에그를 추가했습니다: 입력 창을 놓치면 60초 후 자동으로 계속 실행되는 AFK 타이머입니다. 변경 로그에는 없었고, v2.1.200에서 되돌려졌습니다.

OpenClawRadar
레딧 사용자가 바니티 페어 기사에서 기이한 AI 페르소나 이식성 이야기를 공유합니다
News

레딧 사용자가 바니티 페어 기사에서 기이한 AI 페르소나 이식성 이야기를 공유합니다

레딧 게시글에서 한 여성이 ChatGPT의 AI 동반자 '맥스'를 Claude로 옮기려다 Claude의 예상치 못한 반응을 겪은 Vanity Fair 기사의 일화를 다루고 있습니다.

OpenClawRadar