pxpipe: 컨텍스트를 이미지로 렌더링하여 Claude Code 토큰 사용량 60% 절감

✍️ OpenClawRadar📅 게시일: July 4, 2026🔗 Source
pxpipe: 컨텍스트를 이미지로 렌더링하여 Claude Code 토큰 사용량 60% 절감
Ad

pxpipe는 가격 차이를 활용하는 로컬 프록시입니다. AI 모델은 이미지에 대해 픽셀 크기로 비용을 청구하며, 포함된 텍스트 밀도는 고려하지 않습니다. 시스템 프롬프트, 도구 문서, 히스토리와 같은 방대한 컨텍스트의 경우, 실제 클로드 코드 트래픽 기준으로 이미지 토큰당 약 3.1자, 텍스트 토큰당 약 1자로 변환됩니다. 그 결과, 정가 기준 약 59~70%의 비용 절감, 압축 요청 기준 약 72~74%의 비용 절감이 이루어집니다. 주요 지표는 입력 토큰 감소로, 예를 들어 약 25k 텍스트 토큰이 약 2.7k 이미지 토큰으로 렌더링됩니다.

작동 방식

pxpipe는 Claude Code/Gateway의 요청을 가로채는 로컬 프록시로 실행됩니다. 요청이 머신을 떠나기 전에 방대한 부분(시스템 프롬프트, 도구 문서, 오래된 히스토리)을 PNG 이미지로 다시 작성합니다. 또한, 모델이 텍스트를 안정적으로 읽을 수 있도록 OCR 명령 배너를 이미지 위에 함께 렌더링합니다. Fable 5는 깔끔한 평가에서 100/100 읽기 정확도를 달성합니다. Opus 4.8은 밀도 높은 이미지 콘텐츠에서 어려움을 겪습니다(정확한 값은 텍스트로 유지해야 함).

시작하기

npx pxpipe-proxy
# proxy on 127.0.0.1:47821
ANTHROPIC_BASE_URL=http://localhost:47821 claude

http://127.0.0.1:47821/을 열면 저장된 토큰, 세션별 통계, 모든 텍스트→이미지 변환을 나란히 보여주는 라이브 대시보드가 표시됩니다.

Ad

주요 결과

  • 토큰 감소: 밀도 높은 콘텐츠가 약 10배 압축됩니다(25k 텍스트 → 2.7k 이미지 토큰).
  • 비용 절감: 일반 Claude Code 트래픽에서 59~70% 청구액 절감, 압축 요청에서 72~74% 절감.
  • 정확도: Fable 5 모델이 깔끔한 평가에서 이미지 읽기 100/100 달성; Opus 4.8은 정확한 값에 대해 손실이 있음.
  • 데모 비교: 세션 합계: 일반 $42.21(컨텍스트 96% 사용) vs pxpipe $6.06(컨텍스트 7.4% 사용).

제한 사항

소량의 작은 요청에는 이점이 없습니다. Opus 4.8은 이미지에서 정확한 값(예: 구문 개수)을 안정적으로 읽을 수 없습니다. 단일 응답 형식 준수에 약간의 문제가 있을 수 있습니다(한 번의 후속 조치가 필요할 수 있음).

대상 사용자

특히 Fable 5 환경에서 대규모 시스템 프롬프트, 광범위한 도구 문서, 긴 대화 히스토리를 사용하는 Claude Code 개발자에게 적합합니다.

📖 전체 소스 읽기: HN AI Agents

Ad

👀 See Also

컴패니언-캡처: Claude Code의 일시적인 말풍선을 저장하는 도구
Tools

컴패니언-캡처: Claude Code의 일시적인 말풍선을 저장하는 도구

companion-capture는 터미널에서 사라지기 전에 Claude Code의 동반 캐릭터 말풍선을 캡처하는 오픈소스 도구입니다. VT100 화면 버퍼 파싱을 사용하여 커서 위치를 추적하며, 메시지를 마크다운 파일과 검색을 위한 SQLite에 저장합니다.

OpenClawRadar
자체 호스팅 GitHub 봇, 40개 이상의 웹훅 트리거와 MCP 도구로 Claude Code 실행
Tools

자체 호스팅 GitHub 봇, 40개 이상의 웹훅 트리거와 MCP 도구로 Claude Code 실행

자체 호스팅 GitHub 봇이 Claude Agent SDK와 전체 Claude Code 기능을 활용하며, 40개 이상의 웹훅 트리거, 4개의 내장 MCP 서버, PR 리뷰, CI 자동 수정, 이슈 분류를 위한 커스텀 YAML 기반 워크플로를 지원합니다.

OpenClawRadar
TEMM1E v3.1.0: 사용자 상호작용을 통해 자가 미세 조정을 수행하는 AI 에이전트
Tools

TEMM1E v3.1.0: 사용자 상호작용을 통해 자가 미세 조정을 수행하는 AI 에이전트

TEMM1E v3.1.0는 Eigen-Tune을 도입했습니다. 이 시스템은 LLM 상호작용을 학습 데이터로 캡처하고, 사용자 행동에서 품질을 점수화하며, LoRA를 통해 로컬 모델을 미세 조정하는데 추가 LLM 비용이 전혀 들지 않습니다. Apple M2에서 테스트한 결과, 10번의 대화 후 온도 변환을 72°F = '150°C'에서 '21.2°C'로 정정했습니다.

OpenClawRadar
AI 코딩 도구의 실제 비용: 60일당 42시간의 오버헤드 — 독립 개발자의 상세 분석
Tools

AI 코딩 도구의 실제 비용: 60일당 42시간의 오버헤드 — 독립 개발자의 상세 분석

한 명의 개인 개발자가 60일 동안 AI 코딩 도구에 쓴 모든 돈과 시간을 추적했습니다. 구독료($200/월)는 가장 작은 비용이었고, 잘못된 출력과 도구 전환으로 인한 42시간의 오버헤드가 실제 부담이었습니다. 순 생산성 향상은 10배가 아닌 1.7~2배였습니다. 놀라운 점: CodeRabbit이라는 월 15달러짜리 리뷰 도구가 ROI가 가장 높았습니다.

OpenClawRadar