클로드 코드 세션에서 가치 극대화: 토큰 효율성 팁

Anthropic은 Claude Code 세션에서 사용되는 모든 토큰의 가치를 극대화하는 실용적인 가이드를 발표했습니다. 토큰 가격 책정의 메커니즘을 설명하고, 모델을 전환하지 않고도 낭비를 줄이는 6가지 구체적인 전략을 제시합니다.
토큰 비용을 결정하는 요소
토큰당 비용을 지불하지만, 실제로는 GPU 추론 시간에 대한 비용을 지불하는 것입니다. 토큰의 가격을 결정하는 세 가지 요소는 모델 크기, 입력 대 출력, 캐싱입니다. 출력 토큰은 디코딩이 토큰당 모델을 한 번 실행하기 때문에 입력보다 약 5배 더 비쌉니다. 캐시된 입력 토큰은 더 저렴하며, 프롬프트 캐시는 1시간 후에 만료됩니다.
토큰 낭비를 줄이는 6가지 방법
- 작업 사이에
/clear실행 — 관련 없는 이전 컨텍스트가 모델로 전송되는 것을 방지하여 토큰 사용량을 줄입니다. - 시작 전에 모델과 노력 수준 설정 — 대화 중에 변경하면 프롬프트 캐시가 무효화되어 비용이 증가합니다.
- 파일 이름 대신 @-멘션 사용 — 파일이 메시지에 직접 첨부되어 읽기 호출이나 저장소 검색을 절약합니다.
- 시끄러운 명령에 quiet 플래그를 추가하거나 서브에이전트에서 실행 — 명령 출력은 세션의 나머지 기간 동안 대화에 남아 있습니다.
- 새 세션에서
/context를 한 번 실행 — 로드된 항목(CLAUDE.md, MCP 도구)을 표시하므로 불필요한 항목을 잘라낼 수 있습니다. - 휴식 전에
/compact실행 — 프롬프트 캐시는 1시간 후에 만료되며, 캐시된 동안 요약하는 것이 더 저렴합니다.
가이드는 토큰 효율성이 단순히 전체 사용량을 줄이는 것이 아니라 사용하는 토큰이 실제 작업에 사용되도록 하는 것임을 강조합니다. 예를 들어, 한 세션에서 Claude는 테스트와 해당 파일을 읽고, 편집하고, 몇 턴 만에 완료합니다. 다른 세션에서는 grep으로 검색하고, 같은 두 파일에 도달하기 위해 수십 개의 파일을 읽고, 모든 컨텍스트를 이후의 모든 턴에 끌어와 더 많은 비용이 들고 모델이 관련 없는 파일을 생각하게 만듭니다.
📖 전체 원본 보기: HN AI Agents
👀 See Also

가이드: Windows에서 Lemonade 서버를 통해 로컬 LLM으로 GitHub Copilot 실행하기
개발자가 GitHub Copilot을 Windows 머신, 특히 Framework Desktop에서 로컬 대규모 언어 모델(LLM)과 함께 사용하도록 설정하는 방법에 대한 안내를 공개했습니다. 이 가이드는 해당 설정에 대한 간단한 설명을 찾지 못한 저자가 작성했습니다.

로컬 AI 코딩 에이전트 설정을 위한 OpenCode 시작하기
초보자 가이드는 Mac, Linux, Windows(WSL2)에서 LM Studio, llama.cpp 또는 Ollama를 통해 ByteShape의 최적화된 모델을 사용하여 OpenCode를 완전히 로컬 AI 코딩 에이전트로 설정하는 과정을 안내합니다.

클로드 코드 LSP 설정 가이드: 구조적 코드 이해
레딧 게시물은 구조적 코드 이해를 위해 텍스트 매칭 대신 Language Server Protocol을 사용하도록 Claude Code를 구성하는 방법을 설명하며, 정의로 이동, 참조 찾기, 호출 계층 구조 기능으로 쿼리 시간을 30-60초에서 ~50ms로 줄입니다.

Anthropic, Claude Code 도입을 위한 챔피언 키트 공개
회사에서 Claude Code를 도입하려는 엔지니어를 위한 플레이북: 재사용 가능한 프롬프트 공유, 공개 채널에서 답변 제공, 주간 쇼앤텔 스레드 운영 — 주당 약 40분 소요.