토큰 리듀서: 지능적인 컨텍스트 압축을 위한 Claude 코드 플러그인

Token Reducer는 중대형 저장소 작업 시 과도한 토큰 소비 문제를 해결하는 Claude Code 플러그인입니다. 이 도구는 컨텍스트를 Claude로 전송하기 전에 로컬에서 저장소 컨텍스트를 처리하여 관련 코드를 잃지 않으면서도 컨텍스트 크기를 크게 줄입니다.
작동 방식
이 플러그인은 컨텍스트를 지능적으로 압축하기 위해 여러 기술을 사용합니다:
- AST 기반 청킹 — 코드를 단순 텍스트 분할 대신 의미 있는 단위(함수, 클래스, 블록)로 파싱합니다
- 하이브리드 검색 — BM25(키워드 매칭)와 벡터 유사성을 결합하여 가장 관련성 높은 청크를 찾습니다
- TextRank 압축 — 추출적 요약을 적용하여 중요한 부분은 유지하고 노이즈는 제거합니다
- 임포트 그래프 매핑 — 종속성을 추적하여 관련 코드가 함께 유지되도록 합니다
- 2-홉 심볼 확장 — 함수 A가 함수 B를 호출할 때 작업 중이면 자동으로 B의 컨텍스트를 가져옵니다
성능 및 테스트
Python, TypeScript, JavaScript 저장소에서의 테스트 결과, 개발자는 작업과 관련된 코드를 잃지 않으면서 컨텍스트 크기를 90-98% 줄였다고 보고합니다. 이 도구는 기본 청커로 시작하여 실제 코딩 작업에 대해 테스트하면서 압축이 효과적이면서도 컨텍스트를 보존하도록 Claude 자체를 사용하여 아키텍처를 반복적으로 개선하며 구축되었습니다.
설치 및 이용 가능성
Token Reducer는 완전 무료이며 MIT 라이선스로 제공됩니다. 설치 방법:
/plugin marketplace add Madhan230205/token-reducer
소스 코드는 GitHub의 github.com/Madhan230205/token-reducer에서 확인할 수 있습니다. 개발자는 압축이 워크플로우에 도움이 되는 경우, 중요한 컨텍스트가 누락되는 경우, 그리고 어떤 언어나 저장소 구조가 더 나은 처리가 필요한지에 대한 피드백을 구하고 있습니다.
기술적 세부사항
이 플러그인은 클라우드 API 없이 완전히 로컬에서 실행되며 데이터가 사용자의 컴퓨터를 떠나지 않습니다. 개발자 자신의 프로젝트에서 안정적으로 작동한 후 Claude Code 플러그인으로 패키징되었습니다. 이 저장소는 다양한 언어에 대한 최적화, 더 스마트한 캐싱 추가, 또는 검색 매개변수 조정을 위한 여지가 있어 기여를 받고 있습니다.
📖 Read the full source: r/ClaudeAI
👀 See Also

클로드 코드의 병렬 서브 에이전트: 토큰 절약과 소모의 순간
Anthropic은 멀티 에이전트 시스템이 단일 채팅보다 약 15배 더 많은 토큰을 사용하지만, 프롬프트 캐싱을 통해 토큰 비용을 90% 할인받을 수 있다고 보고합니다. 하위 에이전트가 비용을 절약하거나 낭비하는지는 캐시 적중률에 달려 있습니다.

리더십 앱: 20권 이상의 책에서 추출한 90개 이상의 레슨을 Claude에서 실행합니다
한 개발자가 클로드 내부에서 작동하는 리더십 앱을 만들어, 미완성의 독서 목록을 구조화된 학습 도구로 전환했습니다. 이 앱은 리더십, 습관, 자기 훈련, 영향력, 팀 문화, 부자 마인드셋 등 여러 분야의 20권 이상의 책에서 추출한 90개 이상의 레슨을 포함하고 있습니다. 앱은 구체적인 행동을 제시하는 일일 레슨, 연속 기록 추적, 저널 작성, 검색 기능을 제공합니다.

레딧 사용자가 AI 어시스턴트로부터 개인 지식을 내보내는 상세한 프롬프트를 공유합니다
레딧 사용자가 Anthropic의 ChatGPT 가져오기 기능의 인지된 한계를 해결하며 Claude와 같은 AI 어시스턴트로부터 구조화된 개인 지식을 추출하기 위한 포괄적인 프롬프트를 만들었습니다. 이 프롬프트는 개인 지식 베이스, 지적 프레임워크, 지식 그래프를 다루는 세 가지 별도의 JSON 아티팩트를 생성합니다.
니들: FFN 전혀 없이 구축된 2600만 파라미터 도구 호출 모델
Needle은 MLP가 없는 26M 파라미터 함수 호출 모델로, 소비자 기기에서 6000 tok/s 프리필과 1200 tok/s 디코드를 달성합니다. 단일 호출 도구 호출에서 FunctionGemma-270M, Qwen-0.6B, Granite-350M, LFM2.5-350M을 능가합니다.