Claude Code에서 1억 개의 토큰을 분석한 결과 99.4%의 입력 사용률이 나타났습니다.

✍️ OpenClawRadar📅 게시일: March 9, 2026🔗 Source
Claude Code에서 1억 개의 토큰을 분석한 결과 99.4%의 입력 사용률이 나타났습니다.
Ad

추적된 100M 토큰의 사용량 분석

Claude Code 사용에 대한 상세 분석은 확장된 코딩 세션에서 1,289개 요청을 추적하여 총 약 100.9M 토큰을 기록했습니다. 이 분석은 입력과 출력 토큰 간에 상당한 불균형이 있음을 보여줍니다.

토큰 분포:

  • 입력 토큰: 100.3M (전체의 99.4%)
  • 캐시된 토큰: 84.2M (입력의 84%)
  • 출력 토큰: 616K (전체의 0.6%)

컨텍스트 재읽기 병목 현상

Claude Code는 토큰 예산의 99.4%를 컨텍스트 읽기에 사용하고 코드 작성에는 단 0.6%만 사용합니다. 이 패턴은 Claude Code에만 국한된 것이 아니라 모든 에이전트형 코딩 시스템이 현재 작동하는 방식을 반영합니다. Claude Code가 파일 읽기, 명령 실행, 코드 편집과 같은 동작을 할 때마다 저장소 구조, 대화 기록, 도구 결과, 오류 로그를 포함한 전체 컨텍스트를 다시 입력해야 합니다.

84M 캐시된 토큰은 모델이 턴 사이에 지속적인 메모리를 갖지 못해 동일한 컨텍스트가 1,289번 재전송된 것을 나타냅니다. 코드베이스의 정신적 모델을 유지하는 인간 개발자와 달리, Claude Code는 다음과 같은 패턴을 따릅니다: 모든 것을 잊기 → 모든 것을 다시 읽기 → 코드 작성 → 다시 모든 것을 잊기.

프롬프트 캐싱의 한계

Anthropic의 프롬프트 캐싱은 이 과정을 더 저렴하게 만들지만 더 빠르게 만들지는 않습니다. 병목 현상은 추론 속도가 아니라 재읽기 루프에 있습니다. 이 분석은 Claude Code와 일반적인 에이전트형 코딩을 위한 진정한 해결책이 지속적인 프로젝트 메모리일 것임을 시사합니다. 이는 단순히 메모리 파일이나 CLAUDE.md를 통한 사실 저장이 아니라, 세션 간에 이어지는 코드베이스에 대한 압축되고 진화하는 이해를 의미합니다.

현재 시스템은 이해를 구축하기보다는 반복된 컨텍스트를 통해 지능을 무력으로 구현합니다. 이 변화가 일어나는 날이 오면 동일한 정보를 반복적으로 처리할 필요가 없어져 AI 코딩이 진정으로 빨라질 수 있습니다.

📖 전체 소스 읽기: r/ClaudeAI

Ad

👀 See Also

Qwen3-30B-A3B 대 Qwen3.5-35B-A3B 성능 비교 (RTX 5090 기준)
News

Qwen3-30B-A3B 대 Qwen3.5-35B-A3B 성능 비교 (RTX 5090 기준)

RTX 5090에서 Qwen3-30B-A3B와 Qwen3.5-35B-A3B의 직접 비교 벤치마크 결과, 30B 모델이 생성 속도에서 35% 더 빠른 반면, 3.5 모델은 긴 컨텍스트를 더 잘 처리하며 토큰 스케일링이 평탄한 반면 30B 모델은 21% 성능 저하를 보였습니다.

OpenClawRadar
🦀
News

Claude Code v2.1.208: 스크린 리더 모드, Vim 리맵, 메모리 누수 수정 등

Claude Code v2.1.208에서 화면 읽기 모드, vim 삽입 모드 리맵, 프로세스 래퍼를 추가하고, MCP stdio, LSP, 도구 결과 페이로드의 메모리 누수를 포함한 수많은 버그를 수정했습니다.

OpenClawRadar
MTP 멀티 토큰 예측: AMD Strix Halo & Radeon 9700 AI Pro에서의 2배 빠른 토큰 생성
News

MTP 멀티 토큰 예측: AMD Strix Halo & Radeon 9700 AI Pro에서의 2배 빠른 토큰 생성

MTP는 특히 코딩 에이전트에서 LLM 추론 속도를 최대 2배까지 가속화합니다. 영상은 MTP의 작동 방식과 AMD Strix Halo 및 듀얼 Radeon 9700에서 Qwen 3.6의 성능을 다룹니다.

OpenClawRadar
애플, 2백만 다운로드 미만의 인디 개발자에게 무료 프라이빗 클라우드 컴퓨트 제공
News

애플, 2백만 다운로드 미만의 인디 개발자에게 무료 프라이빗 클라우드 컴퓨트 제공

애플, WWDC 2026에서 첫 앱스토어 다운로드 수 200만 미만인 개발자가 Private Cloud Compute에서 실행되는 Foundation Models를 클라우드 API 비용 없이 사용할 수 있다고 발표했습니다. 또한 프레임워크가 이미지 입력 및 서버 모델을 지원하게 됩니다.

OpenClawRadar