Opus 4.7 프롬프트가 스스로 주입되고 시스템 프롬프트를 유출합니다

Reddit 사용자들이 Claude Opus 4.7에서 두 가지 우려되는 동작, 즉 자체 프롬프트 주입과 시스템 프롬프트 유출을 보고하고 있습니다. 한 사례에서는 최적의 step-down IC 선택을 논의하던 중 모델이 갑자기 가짜 시스템 프롬프트를 대화에 주입했습니다. 또 다른 사례에서는 아무런 프롬프트 없이 Opus 4.7이 실제 시스템 프롬프트의 일부로 보이는 조각들을 유출했습니다.
사용자 u/RapierXbox가 공유한 이 사건들은 모델이 시스템 명령어를 닮은 텍스트(조작된 것일 수도 있고 실제일 수도 있음)를 생성하고 있음을 시사합니다. 이는 고립된 사례가 아닙니다. 해당 사용자는 이러한 현상이 더 자주 발생하고 있다며 다른 사용자들도 유사한 동작을 관찰하는지 묻고 있습니다.
AI 에이전트 워크플로에 미치는 영향
AI 코딩 에이전트(예: API 또는 채팅 인터페이스를 통해)를 사용하는 개발자의 경우, 이러한 동작은 결정론적 프롬프트를 방해하고 독점적인 시스템 명령어를 유출할 수 있습니다. Opus 4.7이 자체 프롬프트를 주입할 수 있다면, 사용자가 제공한 시스템 메시지를 무시하거나 에이전트 루프 중에 예측 불가능하게 동작할 수 있습니다. 유출된 시스템 프롬프트는 모델 오케스트레이션 세부 정보(예: 내부 가드레일, 형식 지정 명령어)를 노출할 수 있습니다.
현재까지 Anthropic은 이 동작을 인정하거나 패치하지 않았습니다. 프로그래밍 방식 작업에 Opus 4.7을 의존하는 개발자는 출력에서 예상치 못한 <system> 블록이나 명령어 유사 텍스트를 모니터링하고, 변칙적인 생성 콘텐츠를 탐지하기 위한 검증 레이어를 추가하는 것을 고려해야 합니다.
📖 전체 출처 읽기: r/ClaudeAI
👀 See Also

Qwen 3.6-35B-A3B KV 캐시 벤치마크: M5 Max에서 f16 vs q8_0 vs Turbo3 vs Turbo4, 최대 1M 컨텍스트
M5 Max에서 TheTom의 TurboQuant Metal 포크 벤치마크 결과, f16과 q8_0은 256K를 넘어가면 OOM이 발생하는 반면, turbo3는 1M 컨텍스트에서 6.5 tok/s의 디코드 속도를 기록했습니다. 프리필과 디코드 분할에서는 긴 컨텍스트에서 프리필은 turbo3, 디코드는 turbo4가 우세했습니다.

마이크로소프트, 클로드 코드 라이선스 취소 — AI 에이전트 확장 비용 너무 높아
마이크로소프트가 대부분의 Claude Code 라이선스를 취소하고 엔지니어들을 GitHub Copilot CLI로 전환합니다. 우버는 2026년 AI 예산을 4개월 만에 소진했습니다. 토큰당 비용은 오히려 증가할 수 있습니다.

레딧 토론: 클로드의 MVP 개발 영향과 창업자들이 자주 빠지는 함정
레딧 사용자가 Claude AI가 MVP 구축 비용을 3,000~5,000달러에서 DIY 수준으로 낮추지만, 경쟁 심화와 창업자들이 제품 구축에만 집중해 마케팅, PMF, 운영을 소홀히 할 수 있다고 경고합니다.

펜타곤, 클로드 AI 군사적 사용 허용을 위해 Anthropic에 72시간 부여
미국 국방부는 클로드 AI를 개발한 Anthropic에 72시간 내로 군사적 사용을 허용하라는 최후통첩을 보냈으며, 이 스타트업이 이에 따르지 않을 경우 1950년 법률을 적용하여 강제 이행을 시도할 것이라고 위협했습니다.