KnightClaw: OpenClaw 에이전트를 위한 로컬 보안 확장

✍️ OpenClawRadar📅 게시일: February 23, 2026🔗 Source
KnightClaw: OpenClaw 에이전트를 위한 로컬 보안 확장
Ad

KnightClaw은 적대적 프롬프트로부터 OpenClaw AI 코딩 에이전트를 보호하도록 설계된 보안 확장 프로그램입니다. 이 도구는 컨텍스트 창에 단일 악성 메시지가 에이전트가 사용자 명령 대신 공격자 지시를 따르도록 할 수 있는 특정 위협 모델을 해결합니다.

핵심 기능

KnightClaw은 구성이 필요 없고 API 키나 클라우드 의존성이 없는 드롭인 확장 프로그램으로 작동합니다. 에이전트에 도달하기 전에 모든 메시지를 가로챕니다.

탐지 시스템

이 가드는 8계층 하이브리드 탐지 접근 방식을 사용합니다:

  • 정규식 패턴
  • 호모글리프 탐지
  • 경계 토큰 분석
  • 퍼플렉서티 점수화
  • 엔트로피 분석
  • 휴리스틱
  • 의미 임베딩 (로컬, 양자화된 BGE 모델 사용)

차단은 마이크로초 단위로 발생합니다.

추가 보안 조치

  • 이그레스 리댁션: 에이전트를 떠나기 전에 아웃바운드 응답에서 비밀을 제거합니다
  • 해시 체인 감사 로그: 모든 차단, 허용 및 구성 변경의 전체 타임라인을 포함하는 변조 방지, 추가 전용 로그
  • 속도 회로 차단기: 60초 내 10회 차단 시 수동 개입 없이 자동 잠금이 트리거됩니다
  • 킬 스위치: 하나의 명령으로 모든 것을 중지합니다: openclaw knight lockdown on

기술적 세부 사항

이 확장 프로그램은 완전히 로컬에서 실행되며 원격 측정 데이터를 전송하지 않으며 MIT 라이선스를 따릅니다. 소스는 테스트 및 기여를 위해 제공됩니다.

📖 전체 소스 읽기: r/openclaw

Ad

👀 See Also

에이전트 격리 보안 분석: 샌드박스 없음에서 파이어크래커 VM까지
Security

에이전트 격리 보안 분석: 샌드박스 없음에서 파이어크래커 VM까지

Cursor, Claude Code, Devin, OpenAI, E2B가 에이전트 워크로드를 어떻게 격리하는지 분석합니다. 샌드박스 없음부터 하드웨어 격리된 Firecracker 마이크로VM까지 다양한 접근 방식을 다룹니다. 컨테이너 런타임은 2019년 이후 매년 탈출 CVE가 발생한 반면, Firecracker는 7년간 게스트-호스트 탈출 사례가 단 한 건도 없습니다.

OpenClawRadar
OpenClaw 보안 경고: 50만 개 공개 인스턴스, 기본 설정으로 시스템 노출 위험
Security

OpenClaw 보안 경고: 50만 개 공개 인스턴스, 기본 설정으로 시스템 노출 위험

보안 분석 결과 50만 개의 OpenClaw 인스턴스가 공개적으로 접근 가능하며, 이 중 3만 개는 알려진 보안 위험을 가지고 있고 1만 5천 개는 알려진 취약점을 통해 악용될 수 있습니다. 기본 설치 시 인증이 비활성화되고 0.0.0.0에 바인딩되어 에이전트 설정이 공개 인터넷에 노출됩니다.

OpenClawRadar
가짜 Claude 사이트가 사이드로딩 공격을 통해 PlugX 멀웨어를 유포합니다
Security

가짜 Claude 사이트가 사이드로딩 공격을 통해 PlugX 멀웨어를 유포합니다

가짜 Claude 웹사이트가 트로이 목마화된 설치 프로그램을 제공하여 DLL 사이드로딩을 통해 PlugX 악성코드를 배포하고, 공격자가 손상된 시스템에 원격으로 접근할 수 있게 합니다. 이 공격은 합법적으로 서명된 G DATA 안티바이러스 업데이터를 사용하여 악성 코드를 로드합니다.

OpenClawRadar
U of T 연구진, 무료 오픈 가중치 모델로 구동 가능한 AI 웜 시연
Security

U of T 연구진, 무료 오픈 가중치 모델로 구동 가능한 AI 웜 시연

토론토 대학교 연구진이 공개 오픈 웨이트 모델을 사용하여 퍼져나가는 방식에 실시간으로 적응하는 AI 웜을 최초로 시연했습니다. 모든 온라인 기기를 대상으로 하며 값비싼 AI가 필요하지 않습니다.

OpenClawRadar