클로드 코드 세션에서 가치 극대화: 토큰 효율성 팁

Anthropic은 Claude Code 세션에서 사용되는 모든 토큰의 가치를 극대화하는 실용적인 가이드를 발표했습니다. 토큰 가격 책정의 메커니즘을 설명하고, 모델을 전환하지 않고도 낭비를 줄이는 6가지 구체적인 전략을 제시합니다.
토큰 비용을 결정하는 요소
토큰당 비용을 지불하지만, 실제로는 GPU 추론 시간에 대한 비용을 지불하는 것입니다. 토큰의 가격을 결정하는 세 가지 요소는 모델 크기, 입력 대 출력, 캐싱입니다. 출력 토큰은 디코딩이 토큰당 모델을 한 번 실행하기 때문에 입력보다 약 5배 더 비쌉니다. 캐시된 입력 토큰은 더 저렴하며, 프롬프트 캐시는 1시간 후에 만료됩니다.
토큰 낭비를 줄이는 6가지 방법
- 작업 사이에
/clear실행 — 관련 없는 이전 컨텍스트가 모델로 전송되는 것을 방지하여 토큰 사용량을 줄입니다. - 시작 전에 모델과 노력 수준 설정 — 대화 중에 변경하면 프롬프트 캐시가 무효화되어 비용이 증가합니다.
- 파일 이름 대신 @-멘션 사용 — 파일이 메시지에 직접 첨부되어 읽기 호출이나 저장소 검색을 절약합니다.
- 시끄러운 명령에 quiet 플래그를 추가하거나 서브에이전트에서 실행 — 명령 출력은 세션의 나머지 기간 동안 대화에 남아 있습니다.
- 새 세션에서
/context를 한 번 실행 — 로드된 항목(CLAUDE.md, MCP 도구)을 표시하므로 불필요한 항목을 잘라낼 수 있습니다. - 휴식 전에
/compact실행 — 프롬프트 캐시는 1시간 후에 만료되며, 캐시된 동안 요약하는 것이 더 저렴합니다.
가이드는 토큰 효율성이 단순히 전체 사용량을 줄이는 것이 아니라 사용하는 토큰이 실제 작업에 사용되도록 하는 것임을 강조합니다. 예를 들어, 한 세션에서 Claude는 테스트와 해당 파일을 읽고, 편집하고, 몇 턴 만에 완료합니다. 다른 세션에서는 grep으로 검색하고, 같은 두 파일에 도달하기 위해 수십 개의 파일을 읽고, 모든 컨텍스트를 이후의 모든 턴에 끌어와 더 많은 비용이 들고 모델이 관련 없는 파일을 생각하게 만듭니다.
📖 전체 원본 보기: HN AI Agents
👀 See Also

캐머플록스 쿠키 인젝션: 당신의 에이전트가 작업하는 동안 당신 자신으로 레딧을 탐색하세요
Firefox 쿠키를 추출하여 Playwright를 통해 Camoufox에 주입하는 방법으로 Reddit 봇 탐지를 우회하는 상세한 가이드

OpenClaw 메모리 플러그인 테스트 결과 및 권장 스택
레딧 사용자가 모든 OpenClaw 메모리 플러그인을 테스트한 결과, 기본 마크다운 설정이 토큰 부풀림과 명령어 압축을 유발한다는 사실을 발견했습니다. 권장 설정은 사람이 읽기 쉬운 노트를 위한 Obsidian, 토큰 비용 없는 검색을 위한 QMD, 구조화된 데이터를 위한 SQLite를 결합하는 것입니다.

API 비용을 피하기 위해 Ollama로 로컬에서 OpenClaw 실행하기
레딧 사용자가 API 기반 OpenClaw에서 Ollama를 사용해 로컬로 전환한 경험을 공유하며, API 비용을 제거하면서도 워크플로우를 유지하는 방법을 소개합니다. 그들은 단계별 설치 비디오 가이드를 제작했습니다.

MCP 서버 자체 설치하기: 세 가지 호스트, 세 가지 메커니즘, 주의사항
VS Code, Cursor, Claude Code에서 MCP 서버를 프로그래밍 방식으로 설치하는 방법 — API, 파일 쓰기, 잘못된 JSON, 원자적 쓰기, 멱등 업데이트 같은 예외 사례를 다룹니다.