PRECC 도구, 사전 도구 호출 압축으로 Claude 코드 API 비용 절감

✍️ OpenClawRadar📅 게시일: April 14, 2026🔗 Source
PRECC 도구, 사전 도구 호출 압축으로 Claude 코드 API 비용 절감
Ad

PRECC는 Claude Code API 비용을 줄이는 오픈 소스 도구로, 모델에 도달하기 전에 중복 컨텍스트를 압축합니다. Bash, Read, Grep 호출을 가로채는 사전 도구 호출 훅을 사용하여 압축 알고리즘을 적용합니다.

작동 방식

이 도구는 중복 컨텍스트가 여러 번 전송되어 API 비용이 증가하는 비용 문제를 해결합니다. 일반적인 낭비 원인은 다음과 같습니다:

  • 동일한 파일 내용이 반복적으로 전송됨
  • 장황한 셸 출력
  • 모델이 전체를 필요로 하지 않는 중복 grep 결과

사전 도구 호출 훅은 도구 출력이 Claude에 도달하기 전에 RTK(Redundancy-aware Token Kompression)를 실행합니다. 압축 과정은 다음과 같습니다:

  • 반복되는 범위를 중복 제거
  • 잡음 제거
  • 대규모 읽기 요약
  • 압축된 버전을 모델에 반환

성능 결과

훅은 약 2.93ms 내에 실행되어 작업에 지각 가능한 지연 시간을 추가하지 않습니다. 실제로 사용자는 일반적인 코딩 세션에서 입력 토큰이 40-66% 감소하는 것을 확인합니다. 압축이 중복성을 제거하면서 신호를 보존하기 때문에 모델 출력 품질은 변하지 않습니다.

이러한 유형의 최적화는 Claude Code를 광범위하게 사용하는 개발자에게 특히 유용합니다. 반복적인 파일 읽기와 도구 출력은 토큰 사용량과 비용을 크게 증가시킬 수 있기 때문입니다.

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

에이전트작업메모리: AI 코딩 에이전트를 위한 로컬 메모리 시스템
Tools

에이전트작업메모리: AI 코딩 에이전트를 위한 로컬 메모리 시스템

AgentWorkingMemory(AWM)는 AI 코딩 에이전트의 세션 간 기억 상실 문제를 해결하는 로컬 메모리 시스템입니다. SQLite 데이터베이스, 세 개의 로컬 ML 모델(총 약 124MB)을 사용하며 MCP를 통해 자동으로 통합되어 Claude Code 세션 전반에 걸쳐 지속적이고 상황 인식 메모리를 제공합니다.

OpenClawRadar
에이전트캐시: 멀티 에이전트 LLM 프리픽스 캐싱을 위한 파이썬 라이브러리
Tools

에이전트캐시: 멀티 에이전트 LLM 프리픽스 캐싱을 위한 파이썬 라이브러리

agentcache는 프롬프트 접두사를 공유하여 캐시 적중률을 최대 76%까지 달성하고 GPT-4o-mini 테스트에서 추론 시간을 절반 이상 단축하는 Python 라이브러리입니다.

OpenClawRadar
PhantomCrowd: Claude Code를 활용한 멀티 에이전트 관객 시뮬레이터
Tools

PhantomCrowd: Claude Code를 활용한 멀티 에이전트 관객 시뮬레이터

PhantomCrowd는 게시 전 콘텐츠에 실제 관객이 어떻게 반응할지 시뮬레이션하는 마케팅 중심의 멀티 에이전트 예측 엔진입니다. 광고 카피나 소셜 게시물과 같은 콘텐츠에 독립적으로 반응하는 고유한 인구통계와 성격을 가진 10-500개의 페르소나를 생성합니다.

OpenClawRadar
Ops Dashboard OpenClaw: 여러 저장소를 가진 솔로 개발자를 위한 로컬 우선 대시보드
Tools

Ops Dashboard OpenClaw: 여러 저장소를 가진 솔로 개발자를 위한 로컬 우선 대시보드

한 명의 솔로 개발자가 Obsidian 저장소, 리포지토리, 로그를 색인하여 하나의 검색 가능한 대시보드로 만든 로컬 퍼스트 앱 ops-dashboard를 개발했습니다. BYOK, MIT 라이선스, 클라우드 불필요.

OpenClawRadar