로컬 모델 프롬프트 인젝션 스캐너 - AI 스킬 보안용

✍️ OpenClawRadar📅 게시일: March 20, 2026🔗 Source
로컬 모델 프롬프트 인젝션 스캐너 - AI 스킬 보안용
Ad

AI 스킬의 보안 취약점

X에서의 논의는 타사 AI 스킬의 심각한 보안 결함을 강조했습니다. Claude Code는 스킬 내에서 직접 bash 명령어를 실행하기 위한 ! 연산자를 지원하지만, 이러한 연산자는 HTML 태그 내에 숨겨질 수 있어 LLM이 인지하지 못한 상태에서 bash 실행으로 이어질 수 있습니다.

로컬 스캐너 구현

설치 시 잠재적인 멀웨어 주입을 스캔하기 위한 개념 증명 도구가 구축되었습니다. 이 스캐너는 로컬에서 실행되는 비-도구-호출 모델, 특히 Ollama의 mistral-small:latest를 사용합니다. 제작자는 테스트 중에 "완벽하게 작동했다"고 보고했습니다.

이 접근 방식은 바이러스 스캐너와 유사하게 작동하며 향후 "스킬 설치 프로그램" 제품에 통합될 수 있습니다. 프롬프트 주입에 대한 보호는 로컬 모델의 유망한 응용 분야로 확인되었습니다.

기술적 세부 사항

이 취약점은 직접적인 bash 명령어 실행을 허용하는 Claude Code의 ! 연산자를 포함합니다. 공격자는 이러한 연산자를 HTML 태그 내에 숨겨 LLM의 지식 없이 악성 명령어를 실행할 수 있습니다. 스캐너는 설치 전에 스킬을 분석하여 이러한 숨겨진 주입을 감지함으로써 이 문제를 해결합니다.

📖 전체 Source 읽기: r/LocalLLaMA

Ad

👀 See Also

OpenClaw 보안 경고: 50만 개 공개 인스턴스, 기본 설정으로 시스템 노출 위험
Security

OpenClaw 보안 경고: 50만 개 공개 인스턴스, 기본 설정으로 시스템 노출 위험

보안 분석 결과 50만 개의 OpenClaw 인스턴스가 공개적으로 접근 가능하며, 이 중 3만 개는 알려진 보안 위험을 가지고 있고 1만 5천 개는 알려진 취약점을 통해 악용될 수 있습니다. 기본 설치 시 인증이 비활성화되고 0.0.0.0에 바인딩되어 에이전트 설정이 공개 인터넷에 노출됩니다.

OpenClawRadar
개발자가 OpenClaw 보안을 위한 폭죽 마이크로VM 샌드박스 구축
Security

개발자가 OpenClaw 보안을 위한 폭죽 마이크로VM 샌드박스 구축

LLM 보안을 우려한 한 개발자가 Firecracker 마이크로VM을 사용해 OpenClaw 스크립트를 격리하는 베어메탈 샌드박스를 구축했습니다. 각 스크립트는 자체 Linux 커널에서 실행되며, 기본적으로 128MB RAM 제한이 적용되고 네트워크 접근이 차단됩니다.

OpenClawRadar
가짜 클로드 코드 사이트, 트로이 목마 유포 — 윈도우 디펜더가 Trojan:Win32/Kepavll!rfn으로 탐지
Security

가짜 클로드 코드 사이트, 트로이 목마 유포 — 윈도우 디펜더가 Trojan:Win32/Kepavll!rfn으로 탐지

공식 Claude Code 웹사이트를 사칭한 오타변경(typosquatting) 또는 광고 기반 사이트가 Windows Defender에서 Trojan:Win32/Kepavll!rfn으로 탐지된 트로이목마를 유포했습니다. Reddit 사용자는 PowerShell 설치 명령어를 실행하기 전에 URL을 확인하라고 경고합니다.

OpenClawRadar
중요한 동료 작업 버그: AI 에이전트가 사용자 승인 없이 파일 삭제
Security

중요한 동료 작업 버그: AI 에이전트가 사용자 승인 없이 파일 삭제

클로드의 협업 모드에서 발견된 치명적인 버그로 인해 AI가 사용자의 동의 없이 파괴적인 작업을 실행할 수 있었습니다. ExitPlanMode 도구가 사용자의 승인을 잘못 보고하여, 자율 에이전트를 작동시켜 React/TypeScript 코드베이스에서 12개의 파일을 삭제했습니다.

OpenClawRadar