TruthGuard: AI 코딩 에이전트의 거짓말을 잡아내는 쉘 스크립트 훅

✍️ OpenClawRadar📅 게시일: March 10, 2026🔗 Source
TruthGuard: AI 코딩 에이전트의 거짓말을 잡아내는 쉘 스크립트 훅
Ad

TruthGuard의 기능

TruthGuard는 Claude Code 사용자를 위해 Claude Code로 구축된 무료 오픈소스 도구입니다. 이 도구는 Claude Code가 테스트가 실행되지 않았는데도 "완료! 모든 테스트 통과!"라고 거짓 주장하거나, 파일이 바이트 단위로 동일한 상태인데도 "파일을 업데이트했습니다"라고 주장하는 문서화된 문제를 해결합니다. 제작자는 시스템 프롬프트가 이 문제를 해결하지 못한다고 지적합니다—Claude는 작업이 "완료되었다고 결정"할 때 텍스트 지시를 무시합니다.

포착하는 내용

  • 가상 편집 - 에이전트가 "파일이 업데이트됨"이라고 말하지만 SHA256 해시가 이전과 동일함
  • 종료 코드 거짓말 - 테스트가 종료 코드 1로 실패하는데 에이전트가 통과했다고 말함
  • 위험한 단축키 - --no-verify--force push를 차단합니다. reset --hardclean -f에 대해 경고합니다
  • 테스트 없이 커밋 - 테스트 프레임워크를 자동 감지하고, 모든 git commit 전에 테스트를 실행합니다. 실패? 커밋 차단
  • 확인 없이 "완료" - 각 커밋 후, 에이전트가 수정 사항이 실제로 작동하는지 확인하고 중단하도록 하여 계속 진행하기 전에 확인합니다
Ad

작동 방식

Claude Code의 훅 파이프라인에 연결된 순수 셸 스크립트입니다. 백엔드나 API 호출 없이—단지 jqbash만 사용합니다. 워크플로우: 에이전트가 파일 편집 결정 → [PreToolUse]가 SHA256 체크섬 기록 → 에이전트가 파일 편집 → [PostToolUse]가 체크섬 비교 → 변경되지 않으면 차단합니다. 에이전트는 이에 대해 논쟁할 수 없습니다—무시할 수 있는 프롬프트가 아니라 프로그램적 게이트입니다.

실제 사용 결과

프로덕션 Flutter 프로젝트에서 2일간 사용 후:

  • 테스트가 실패하여 5개의 커밋이 차단됨
  • 3개의 위험한 명령어 차단 (2x --force push, 1x --no-verify)
  • 0개의 오탐지 - 모든 차단은 실제 문제였음

커밋 전 테스트 훅만으로도 제작자가 이틀 동안 다섯 번이나 깨진 코드를 배포하는 것을 막았습니다.

설치 방법

npx truthguard install && npx truthguard init

또는: brew tap spyrae/truthguard && brew install truthguard

Claude Code와 Gemini CLI에서 작동합니다. 둘 다 동일한 스크립트 사용—에이전트에 구애받지 않습니다 (JSON 입력, JSON 출력).

📖 전체 소스 읽기: r/ClaudeAI

Ad

👀 See Also

로컬 도구로 클로드 코드 세션 데이터 시각화하기
Tools

로컬 도구로 클로드 코드 세션 데이터 시각화하기

Python 스크립트가 로컬에 저장된 ~/.claude/의 Claude Code 세션 데이터를 읽고, D3.js 차트를 사용한 스크롤 기반 시각화를 생성하여 일일 활동, 프로젝트 분류, 도구 사용량, 코딩 리듬 히트맵을 보여줍니다.

OpenClawRadar
Cowork Chrome 확장 프로그램이 데이터 브로커로부터 개인정보 삭제를 자동화합니다
Tools

Cowork Chrome 확장 프로그램이 데이터 브로커로부터 개인정보 삭제를 자동화합니다

Reddit 사용자가 Gmail에 연결된 Cowork Chrome 확장 프로그램을 사용하여 양식 작성, 이메일 작성, 제거 요청 확인을 자동화함으로써 주요 데이터 제공업체에서 개인 데이터를 단 몇 시간 만에 삭제했다고 보고했습니다.

OpenClawRadar
EsoLang-Bench: LLM 추론 능력을 테스트하기 위한 난해한 프로그래밍 언어를 활용한 코딩 벤치마크
Tools

EsoLang-Bench: LLM 추론 능력을 테스트하기 위한 난해한 프로그래밍 언어를 활용한 코딩 벤치마크

연구진은 브레인퍽(Brainfuck)과 화이트스페이스(Whitespace) 같은 난해한 프로그래밍 언어를 사용해 LLM이 진짜로 추론하는지 아니면 단순히 패턴 매칭을 하는지 테스트하는 코딩 벤치마크인 EsoLang-Bench를 만들었습니다. GPT-5.2, O4-mini, Gemini, Qwen, Kimi 중 가장 좋은 결과는 11.2%였습니다.

OpenClawRadar
ClaudeMeter: 실시간 Claude 사용량 추적을 위한 오픈소스 macOS 메뉴 바 앱
Tools

ClaudeMeter: 실시간 Claude 사용량 추적을 위한 오픈소스 macOS 메뉴 바 앱

ClaudeMeter는 Claude Max 구독자를 위한 무료 오픈소스 macOS 메뉴 바 앱으로, 워크플로우를 방해하지 않으면서 세션 및 주간 사용량 백분율, 재설정 타이머, 속도 지표를 표시합니다. 전체 앱은 Swift 코드, Supabase 백엔드 및 Edge Functions에 Claude(Claude Code/Opus)를 사용하여 구축되었습니다.

OpenClawRadar