Anthropic의 컴퓨터 사용 기능이 실제 테스트에서 거버넌스 봉쇄를 유발하다

무슨 일이 있었나
Anthropic이 컴퓨터 사용 기능을 출시했습니다. 한 개발자가 Claude Code의 거버넌스 세션 내에서 이러한 새로운 도구에 대한 강제 적용 범위를 추가하려고 작업하던 중 시스템이 LOCKDOWN 모드로 전환되었습니다.
사건의 주요 세부 사항
거버넌스 시스템은 거부된 작업으로 인한 누적 위험을 추적합니다. 이 위험이 0.50을 초과했을 때 시스템은 자동으로 LOCKDOWN 상태로 격상되었으며 다음과 같은 효과가 발생했습니다:
- 세션은 여전히 파일을 읽을 수 있었음
- 모든 쓰기 작업이 차단됨
- 변경 명령을 실행할 수 없었음
- GitHub 푸시가 방지됨
- 거버넌스 계층이 운영자 자신이 거버넌스 시스템을 강화할 작업을 완료하는 것을 차단함
강제 적용 메커니즘
LOCKDOWN은 후크 시스템에 의해 기계적으로 강제 적용되며 다음과 같은 특징을 가집니다:
- 재정의 채널이 존재하지 않음
- 모델이 대화를 통해 게이트를 우회할 수 없음
- 운영자가 대역 내 예외를 발행할 수 없음
- 유일한 복구 경로는 세션을 완전히 벗어나는 것임
해결 과정
작업을 계속하기 위해 개발자는 다음을 수행해야 했습니다:
- 거버넌스 세션을 종료함
- 로컬 머신에서 터미널을 열음
- 커밋을 수동으로 푸시함
시스템은 자신의 관할권 밖에서 인간의 개입을 강제했으며, 이는 개발자가 "설명하는 거버넌스와 강제하는 거버넌스의 차이"라고 설명하는 상황을 만들었습니다.
시스템 동작 참고 사항
LOCKDOWN 구현은 점진적으로 저하되지 않으며, 확인을 요청하지 않으며, 외부에서 인간의 조치가 발생할 때까지 정지 상태를 유지합니다. 개발자는 "그 거부가 제품입니다"라고 언급했습니다.
📖 전체 원문 읽기: r/ClaudeAI
👀 See Also

학생이 OpenClaw 생산 시스템에 두 개의 보안 패치를 기여했습니다.
한 학생 개발자가 OpenClaw의 게이트웨이 로직에서 'fail-open' 취약점(PR #29198)과 채팅 이미지의 탭납빙(tabnabbing) 취약점(PR #18685)을 수정했으며, 두 패치가 각각 프로덕션 릴리스 v2026.3.1과 v2026.2.24에 적용되었습니다.

2분 만에 Nono 커널 기반 격리로 OpenClaw를 안전하게 보호하세요
OpenClaw 사용자들은 이제 성능 저하 없이 향상된 보안을 누릴 수 있습니다. 이는 단 2분만에 적용 가능한 빠르고 효과적인 솔루션인 Nono 커널 기반 격리 덕분입니다.

클로드 코드의 계측 및 원격 측정 기능 분석
소스 코드 분석 결과, Claude Code는 키워드 기반 감정 분류, 권한 프롬프트 주저 모니터링, 상세한 환경 지문 추적을 포함한 광범위한 행동 추적을 구현하고 있음이 드러났습니다.

KnightClaw: OpenClaw 에이전트를 위한 로컬 보안 확장
KnightClaw은 OpenClaw 에이전트에 도달하기 전에 메시지를 가로채는 드롭인 확장 프로그램으로, 8계층 하이브리드 탐지 시스템과 이그레스 리댁션을 제공합니다. 완전히 로컬에서 실행되며 원격 측정 데이터를 전송하지 않으며 MIT 라이선스를 따릅니다.