깊이 패킹된 코드베이스 컨텍스트를 위한 MCP 서버

한 개발자가 토큰 예산 내에서 5단계 깊이 수준으로 코드베이스 컨텍스트를 압축하는 MCP 서버를 만들었습니다. 이 도구는 특정 문제를 해결합니다: Claude Code나 다른 AI 코딩 에이전트가 "인증은 어떻게 작동하나요?"와 같은 질문을 할 때, 일반적으로 3개의 파일만 완전히 로드하거나(큰 그림을 놓침) 실제 내용 없이 평평한 저장소 맵을 얻습니다.
작동 방식
이 서버는 이러한 극단 사이에 위치하며, 등급별 깊이 수준에서 40개 이상의 파일을 압축합니다. 가장 관련성 높은 파일은 전체 내용으로 포함되고, 주변 파일은 경로만으로 표현됩니다. 이 접근 방식은 토큰 제약 내에서 폭과 깊이를 모두 제공합니다.
세 가지 검색 모드
- 키워드 모드: 자유 텍스트 검색
- 의미 모드: 임베딩 사용(~쿼리당 $0.0001)
- 그래프 모드: 임포트 관계 추적
이러한 모드는 더 정교한 검색을 위해 함께 구성될 수 있습니다.
기술 구현
서버는 tree-sitter를 통한 AST 파싱을 사용하며 14개의 프로그래밍 언어를 지원합니다. 여러 MCP 도구를 제공합니다:
packindex_workspaceindex_github_repobuild_embeddingsresolvestats
이 도구는 https://github.com/victorgjn/agent-skills에서 GitHub에서 이용 가능합니다. 개발자는 아직 skills.sh에 스킬을 게시하지 않았지만 곧 게시할 계획이라고 언급했습니다.
📖 Read the full source: r/ClaudeAI
👀 See Also
OpenClaw 에이전트에 전화를 주세요: 음성 통화를 위한 오픈 소스 플러그인
개발자가 OpenClaw로 전화를 걸 수 있는 오픈소스 플러그인을 공개했습니다. 월 20달러의 SaaS 대안과 달리 무료이며 자체 호스팅이 가능합니다.

비용 효율적인 AI 작업 라우팅을 위한 RouteLLM 설정
레딧 사용자가 Ollama의 로컬 Qwen3.5:4b 모델과 GitHub Copilot을 OpenWire를 통해 결합한 Docker Compose 구성을 공유했습니다. RouteLLM을 사용하여 복잡한 작업은 GPT-4o로 라우팅하고 간단한 작업은 로컬에서 처리합니다.

LLM 컨텍스트 윈도우를 위한 더블 버퍼링 기술로 스톱-더-월드 컴팩션을 제거합니다
더블 버퍼링이라는 기술은 초기에 요약을 수행하고 두 개의 버퍼를 유지함으로써 컨텍스트 윈도우 압축 중에 LLM 에이전트가 멈추는 것을 방지할 수 있으며, 추가 추론 비용 없이 원활한 전환을 가능하게 합니다.

NPCterm: AI 에이전트를 위한 MCP 기반 완전 PTY 터미널 에뮬레이터
NPCterm는 MCP를 통해 노출되는 헤드리스, 인메모리 PTY 터미널 에뮬레이터를 통해 AI 에이전트에 완전한 터미널 접근을 제공합니다. 여기에는 터미널 제어, 프로세스 상태 감지 및 TUI 애플리케이션 지원을 위한 15개의 MCP 도구가 포함됩니다.