오픈소스 AI 에이전트 파이프라인용 구조적 환각 검사기

기능
AI 에이전트 파이프라인을 위해 특별히 설계된 구조적 환각 검사기입니다. 사실 확인과 달리, 이 도구는 다운스트림 도구를 중단시키는 구조적 실패를 포착하는 데 중점을 둡니다.
해결하는 문제
대부분의 에이전트 문제는 사실 오류가 아닌 다음과 같은 구조적 문제입니다:
- 모델이 JSON 도구 응답에 필드를 임의로 추가하는 경우
- 검색된 집합에 없던 소스를 인용하는 경우
- 검색된 콘텐츠 내에 숨겨진 프롬프트 주입
- 도구가 반환하지 않은 내용을 반환했다고 주장하는 경우
네 가지 억제기
이 도구에는 Claude Code로 구축된 네 가지 억제기가 포함되어 있으며, 에이전트 출력이 사용자에게 도달하기 전에 단일 단계로 실행됩니다:
grounding_enforcer- 모델 출력이 실제로 전달된 소스에 의해 지원되는지 확인prompt_suppressor- 검색된 콘텐츠 및 도구 결과에서 주입 시도를 포착json_suppressor- 구조화된 도구 응답을 예상 스키마에 대해 검증tool_response_suppressor- 도구의 주장된 출력이 실제 반환 내용과 일치하지 않을 때 표시
이용 가능성
이 도구는 두 가지 형식으로 이용 가능합니다:
- REST API
- MCP 서버 (Claude Desktop, Cursor, Windsurf 등과 호환)
무료 티어는 신용카드 없이 월 500회 요청을 제공합니다.
소스 및 문서
GitHub 저장소: https://github.com/steveswain14/mcp-hallucination-suite
API 및 문서: https://certifai.dev
📖 전체 소스 읽기: r/ClaudeAI
👀 See Also
Keenable SELECT: 웹 검색 결과에 SQL 쿼리 실행
Keenable SELECT는 MCP 서버로, SQL을 사용하여 웹을 쿼리할 수 있게 해줍니다. 한 번의 호출로 1,000개 이상의 페이지를 검색하고, 정확한 WHERE 절로 필터링하며, LLM을 통해 필드를 추출할 수 있습니다—하나의 SELECT 문으로 모두 가능합니다.

TREX: 코드를 실행하는 Greptile의 AI 코드 리뷰어
TREX는 Greptile의 AI 코드 리뷰에 내장된 코드 실행 계층입니다. 코드를 실행하고 스크린샷, 로그, 추적을 제공하여 정적 분석이 놓치는 버그를 잡아냅니다.

Claude-실시간-비디오: 모든 LLM을 위한 장면 인식 프레임 추출 + 대본
비디오에서 장면 인식, 중복 제거된 프레임과 오디오 전사를 추출하는 오픈소스 도구로, 어떤 LLM이든 업로드 없이 로컬에서 비디오를 '시청'할 수 있게 합니다. 장면 변경 감지, 슬라이딩 윈도우 중복 제거, Whisper 전사 기능을 제공합니다.

수행사: 에이전트 내레이션을 침묵시켜 맥락과 토큰을 절약하는 기술
레딧 사용자가 클로드 에이전트 응답에서 서사, 서문, 후문을 제거하는 스킬 'monk'를 게시했으며, 턴당 출력 토큰이 약 54% 감소하고 100회에서 컨텍스트 용량이 29-39% 증가한다고 주장합니다.