LLMock: 프로세스 간 결정론적 LLM 테스트를 위한 HTTP 기반 모킹 서버

✍️ OpenClawRadar📅 게시일: March 14, 2026🔗 Source
LLMock: 프로세스 간 결정론적 LLM 테스트를 위한 HTTP 기반 모킹 서버
Ad

LLMock는 지정된 포트에서 실제 HTTP 서버로 실행되어 LLM API 호출을 가로채는 모킹 서버로, 유료 API를 호출하지 않고도 여러 프로세스에서 결정론적 테스트를 가능하게 합니다.

주요 내용

이 도구는 한 개발자가 실제 OpenAI API를 대상으로 Playwright 테스트를 실행하며 12달러를 소비한 후 발견되었습니다. 문제는 MSW(Mock Service Worker)를 사용할 때 발생했는데, MSW는 server.listen()을 호출하는 Node.js 프로세스 내부의 HTTP 모듈을 패치하지만, 별도의 프로세스(예: Python 에이전트)는 모킹을 전혀 인식하지 못했습니다.

LLMock를 사용하면 Node.js, Python 또는 기타 언어에 관계없이 모든 프로세스에서 OPENAI_BASE_URL 환경 변수를 모킹 서버로 지정합니다:

const mock = new LLMock({ port: 5555 });
await mock.start();
process.env.OPENAI_BASE_URL = "http://localhost:5555/v1";

픽스처는 사용자 메시지 부분 문자열이나 정규식 패턴과 일치하는 일반 JSON 파일로, 핸들러 보일러플레이트를 제거합니다:

{
  "fixtures": [
    {
      "match": { "userMessage": "stock price of AAPL" },
      "response": { "content": "The current stock price of Apple Inc. (AAPL) is $150.25." }
    }
  ]
}

소스에서 언급된 주요 기능:

  • 실제 OpenAI/Claude/Gemini SSE 형식을 정확히 지원합니다(이벤트 유형을 잘못 설정하면 스트리밍이 미묘하게 중단됨)
  • 전체 도구 호출 지원 - 에이전트 프레임워크가 정상적으로 실행함
  • 다중 에이전트 흐름을 위한 시스템 프롬프트 상태 또는 메시지 기록 검사를 위한 조건부 라우팅
  • 테스트 통과 여부뿐만 아니라 실제 호출 내용을 확인할 수 있는 요청 기록
  • 의존성 없음

해당 개발자는 3개의 Playwright 테스트에서 9번의 LLM 호출을 수행했으며, 비용은 0달러이고 매 실행마다 결정론적 결과를 얻었습니다.

📖 전체 소스 읽기: r/LocalLLaMA

Ad

👀 See Also

Next.js 개발을 위한 병렬 Claude 채팅 아키텍처
Tools

Next.js 개발을 위한 병렬 Claude 채팅 아키텍처

한 개발자가 동일한 Next.js 코드베이스에서 여러 Claude AI 채팅을 동시에 실행하는 시스템을 구축했습니다. 이 시스템은 공유 데이터베이스 테이블과 폴링 에이전트를 사용하여 87%의 빌드 성공률과 한 세션에서 제로 머지 충돌을 달성했습니다.

OpenClawRadar
Git Worktrees를 사용한 Claude 코드용 병렬 에이전트 오케스트레이터
Tools

Git Worktrees를 사용한 Claude 코드용 병렬 에이전트 오케스트레이터

한 개발자가 깃 워크트리를 사용하여 Claude Code 에이전트를 위한 격리된 환경을 생성하는 병렬 오케스트레이터를 구축했으며, 이로 인해 공유 작업 디렉터리로 인해 앱이 손상되고 깃 상태가 지저분해지는 문제를 해결했습니다.

OpenClawRadar
WAYD: Claude Code, Cursor, Copilot CLI에서의 60초 소셜 브레이크
Tools

WAYD: Claude Code, Cursor, Copilot CLI에서의 60초 소셜 브레이크

WAYD는 Claude Code, Cursor, Copilot CLI를 위한 플러그인으로, 터미널에서 감정 태그로 코딩 하루의 한 줄 분위기를 올리고 다른 개발자들의 반응을 보며 피드를 스크롤할 수 있습니다. GitHub Issues로 구동됩니다.

OpenClawRadar
RRF를 활용한 하이브리드 검색은 순수 벡터 검색보다 AI 메모리 시스템을 향상시킵니다
Tools

RRF를 활용한 하이브리드 검색은 순수 벡터 검색보다 AI 메모리 시스템을 향상시킵니다

PostgreSQL와 pgvector를 사용하는 오픈소스 AI 메모리 시스템은 순수 벡터 검색만으로는 정확한 일치 검색에 부족함을 발견했습니다. 그래서 전문 검색을 추가하고 k=60의 Reciprocal Rank Fusion(RRF)을 사용해 결과를 병합했으며, 토크나이저를 통한 쿼리 강화도 적용했습니다.

OpenClawRadar