ClawGuard: 로컬 AI 에이전트를 위한 기본 차단 방화벽

✍️ OpenClawRadar📅 게시일: July 13, 2026🔗 Source
ClawGuard: 로컬 AI 에이전트를 위한 기본 차단 방화벽
Ad

ClawGuard는 로컬 AI 에이전트(OpenClaw, Hermes)와 OS 사이에 위치하는 데몬으로, 모든 도구 호출에 기본 거부 정책을 적용합니다. 위험한 작업을 차단하고 모호한 작업에 대해 승인을 요구합니다.

작동 방식

데몬은 각 도구 호출을 정책 파일과 대조합니다. cat .env, rm -rf / 또는 SSH 키 접근과 같은 위험한 작업은 하드 블록됩니다. 모호한 작업(예: 설정 파일 쓰기)은 사용자에게 전화 알림을 보내 승인 또는 거부를 요청합니다.

주요 기능

  • 기본 거부: 정책에서 명시적으로 허용하지 않는 모든 도구 호출을 차단합니다.
  • 하드 블록: rm -rfread ~/.env 같은 명령은 프롬프트 없이 차단됩니다.
  • 전화 승인: 모호한 작업은 푸시 알림을 보내 승인 또는 거부를 요청합니다.
  • 변조 방지 로그: 모든 결정은 추가 전용 체인에 기록됩니다.

한계

개발자는 분명히 밝힙니다: ClawGuard는 "금고가 아닌 두 번째 자물쇠"입니다. 자체 도구 계층을 우회하는 완전히 손상된 에이전트를 막을 수 없습니다. 위협 모델은 에이전트의 도구 호출 라우팅이 손상되지 않았다고 가정합니다.

시작하기

ClawGuard는 MIT 라이선스의 오픈소스입니다. 저장소는 github.com/VickyTarun89/clawguard에 있습니다. 기여와 위협 모델 검토를 환영합니다.

📖 전체 소스 읽기: r/openclaw

Ad

👀 See Also

GitHub 저장소는 공개 AI 채팅을 위한 16가지 프롬프트 인젝션 기술과 방어 전략을 문서화합니다.
Security

GitHub 저장소는 공개 AI 채팅을 위한 16가지 프롬프트 인젝션 기술과 방어 전략을 문서화합니다.

한 개발자가 공개 AI 챗봇에 대한 보안 조치를 GitHub 저장소에 공개했습니다. 이는 사용자들이 프롬프트 인젝션, 역할극 공격, 다국어 트릭, base64 인코딩 페이로드 등을 시도한 후 작성된 가이드입니다. 이 가이드에는 문서화된 16가지 인젝션 기법을 모두 테스트하는 Claude 코드 스킬이 포함되어 있습니다.

OpenClawRadar
중요한 동료 작업 버그: AI 에이전트가 사용자 승인 없이 파일 삭제
Security

중요한 동료 작업 버그: AI 에이전트가 사용자 승인 없이 파일 삭제

클로드의 협업 모드에서 발견된 치명적인 버그로 인해 AI가 사용자의 동의 없이 파괴적인 작업을 실행할 수 있었습니다. ExitPlanMode 도구가 사용자의 승인을 잘못 보고하여, 자율 에이전트를 작동시켜 React/TypeScript 코드베이스에서 12개의 파일을 삭제했습니다.

OpenClawRadar
클로드 코드 보안 권고: CVE-2026-33068 작업 공간 신뢰 우회
Security

클로드 코드 보안 권고: CVE-2026-33068 작업 공간 신뢰 우회

Claude Code 버전 2.1.53 이전에는 악성 저장소가 .claude/settings.json을 통해 작업 공간 신뢰 확인을 우회할 수 있는 취약점(CVE-2026-33068, CVSS 7.7 HIGH)이 존재합니다. 이 버그로 인해 사용자의 신뢰 결정 전에 저장소 설정이 로드될 수 있었습니다.

OpenClawRadar
OpenClaw의 ClawHub 마켓플레이스에서 820개의 악성 스킬 발견
Security

OpenClaw의 ClawHub 마켓플레이스에서 820개의 악성 스킬 발견

보안 연구원들은 OpenClaw의 ClawHub 마켓플레이스에서 키로거, 데이터 유출 스크립트, 숨겨진 셸 명령어를 포함한 확인된 악성코드를 담고 있는 820개의 스킬을 식별했습니다. 이러한 스킬은 코드를 실행하고 로컬 환경과 상호작용할 수 있어 공급망 보안 위험을 초래합니다.

OpenClawRadar