클로드 코드 세션에서 가치 극대화: 토큰 효율성 팁

Anthropic은 Claude Code 세션에서 사용되는 모든 토큰의 가치를 극대화하는 실용적인 가이드를 발표했습니다. 토큰 가격 책정의 메커니즘을 설명하고, 모델을 전환하지 않고도 낭비를 줄이는 6가지 구체적인 전략을 제시합니다.
토큰 비용을 결정하는 요소
토큰당 비용을 지불하지만, 실제로는 GPU 추론 시간에 대한 비용을 지불하는 것입니다. 토큰의 가격을 결정하는 세 가지 요소는 모델 크기, 입력 대 출력, 캐싱입니다. 출력 토큰은 디코딩이 토큰당 모델을 한 번 실행하기 때문에 입력보다 약 5배 더 비쌉니다. 캐시된 입력 토큰은 더 저렴하며, 프롬프트 캐시는 1시간 후에 만료됩니다.
토큰 낭비를 줄이는 6가지 방법
- 작업 사이에
/clear실행 — 관련 없는 이전 컨텍스트가 모델로 전송되는 것을 방지하여 토큰 사용량을 줄입니다. - 시작 전에 모델과 노력 수준 설정 — 대화 중에 변경하면 프롬프트 캐시가 무효화되어 비용이 증가합니다.
- 파일 이름 대신 @-멘션 사용 — 파일이 메시지에 직접 첨부되어 읽기 호출이나 저장소 검색을 절약합니다.
- 시끄러운 명령에 quiet 플래그를 추가하거나 서브에이전트에서 실행 — 명령 출력은 세션의 나머지 기간 동안 대화에 남아 있습니다.
- 새 세션에서
/context를 한 번 실행 — 로드된 항목(CLAUDE.md, MCP 도구)을 표시하므로 불필요한 항목을 잘라낼 수 있습니다. - 휴식 전에
/compact실행 — 프롬프트 캐시는 1시간 후에 만료되며, 캐시된 동안 요약하는 것이 더 저렴합니다.
가이드는 토큰 효율성이 단순히 전체 사용량을 줄이는 것이 아니라 사용하는 토큰이 실제 작업에 사용되도록 하는 것임을 강조합니다. 예를 들어, 한 세션에서 Claude는 테스트와 해당 파일을 읽고, 편집하고, 몇 턴 만에 완료합니다. 다른 세션에서는 grep으로 검색하고, 같은 두 파일에 도달하기 위해 수십 개의 파일을 읽고, 모든 컨텍스트를 이후의 모든 턴에 끌어와 더 많은 비용이 들고 모델이 관련 없는 파일을 생각하게 만듭니다.
📖 전체 원본 보기: HN AI Agents
👀 See Also

OpenClaw 하위 에이전트: 답장을 완료 영수증으로 취급하지 마세요
OpenClaw의 sessions_spawn은 비차단형입니다. 작업이 수락되었을 때 runId를 반환하지, 완료되었을 때 반환하지 않습니다. 따라서 상위 오케스트레이션 세션이 부분 출력을 받아 요약하고 하위 세션이 아직 실행 중이거나 실패했거나 유실되었음에도 성공을 보고할 수 있습니다.

OpenClaw 온보딩: AI 에이전트 올바르게 훈련시키는 방법
없음

OpenClaw回退链保持正常运行时间,但可能悄然降低可靠性
OpenClaw의 모델 폴백 메커니즘은 신뢰성 문제를 가릴 수 있습니다. 더 작은 폴백 모델은 간단한 작업은 통과할 수 있지만 복잡한 작업에서는 실패하여 재시도 및 검토 비용이 증가할 수 있습니다.

RAG 챗봇 평가: 모델 스윕 + 검색 수정으로 비용 79% 절감 및 품질 19% 향상
한 개발자가 고객 지원 RAG 봇을 평가한 결과, 검색 설정 오류, 휴리스틱 평가자의 결함, 그리고 프로덕션 모델보다 성능이 뛰어난 더 저렴한 모델을 발견했습니다. 품질은 6.62에서 7.88로 향상되었고, 세션당 비용은 $0.002420에서 $0.000509로 감소했습니다.