Анализ 100 миллионов токенов в Claude Code показывает использование входных данных на 99,4%.

✍️ OpenClawRadar📅 Опубликовано: 9 марта 2026 г.🔗 Source
Анализ 100 миллионов токенов в Claude Code показывает использование входных данных на 99,4%.
Ad

Разбивка использования токенов на основе отслеживания 100 млн токенов

Детальный анализ использования Claude Code отследил 1289 запросов в ходе продолжительных сессий программирования, в общей сложности около 100,9 млн токенов. Разбивка показывает значительный дисбаланс между входными и выходными токенами.

Распределение токенов:

  • Входные токены: 100,3 млн (99,4% от общего количества)
  • Закэшированные токены: 84,2 млн (84% от входных)
  • Выходные токены: 616 тыс. (0,6% от общего количества)

Узкое место повторного чтения контекста

Claude Code тратит 99,4% своего токенного бюджета на чтение контекста и всего 0,6% на написание кода. Эта закономерность не характерна только для Claude Code, а отражает то, как в настоящее время работают все агентные системы программирования. Каждый раз, когда Claude Code выполняет действие — читает файл, запускает команду, редактирует код — ему требуется повторная подача полного контекста, включая структуру репозитория, историю диалога, результаты работы инструментов и журналы ошибок.

84 млн закэшированных токенов представляют собой один и тот же контекст, повторно отправляемый 1289 раз, потому что модель не имеет постоянной памяти между шагами. В отличие от разработчиков-людей, которые сохраняют ментальную модель своей кодовой базы, Claude Code следует шаблону: забыть всё → перечитать всё → написать код → снова забыть всё.

Ad

Ограничения кэширования промптов

Кэширование промптов от Anthropic делает этот процесс дешевле, но не быстрее. Узким местом является не скорость вывода — это цикл повторного чтения. Анализ предполагает, что реальным прорывом для Claude Code и агентного программирования в целом стала бы постоянная память проекта — не просто сохранённые факты через файлы памяти или CLAUDE.md, а сжатое, развивающееся понимание кодовой базы, которое переносится между сессиями.

Текущие системы по сути насильно добиваются интеллекта через повторяющийся контекст вместо построения понимания. День, когда это изменится, может сделать ИИ-программирование по-настоящему быстрее, устранив необходимость многократной обработки одной и той же информации.

📖 Прочитать полный источник: r/ClaudeAI

Ad

👀 Смотрите также

Qwen KV 缓存量化深度解析:PPL、KL散度与非对称K/V结果
Новости

Qwen KV 缓存量化深度解析:PPL、KL散度与非对称K/V结果

Второй раунд тестов Qwen 3.6-35B-A3B с квантованием KV-кэша: перплексия, KL-дивергенция, асимметричные комбинации K/V и глубина контекста 64K на Apple M5 Max.

OpenClawRadar
Разработчики эмулятора PS3 просят прекратить отправку PR, сгенерированных ИИ
Новости

Разработчики эмулятора PS3 просят прекратить отправку PR, сгенерированных ИИ

Мейнтейнеры RPCS3 публично попросили пользователей прекратить отправлять пул-реквесты, созданные AI-агентами кода, ссылаясь на низкое качество и нагрузку на поддержку.

OpenClawRadar
Gemini Embedding 2: Первая нативная мультимодальная модель эмбеддингов от Google
Новости

Gemini Embedding 2: Первая нативная мультимодальная модель эмбеддингов от Google

Google выпустила Gemini Embedding 2, свою первую нативно мультимодальную модель эмбеддингов, которая преобразует текст, изображения, видео, аудио и документы в единое пространство эмбеддингов. Модель поддерживает до 8192 текстовых токенов, 6 изображений на запрос, 120 секунд видео и PDF-файлы длиной до 6 страниц, с гибкими выходными размерностями от 3072 до 768.

OpenClawRadar
Google AI ошибочно назвал канадского скрипача сексуальным преступником, подан иск
Новости

Google AI ошибочно назвал канадского скрипача сексуальным преступником, подан иск

Эшли Макисаак подает в суд на Google на $1,5 млн после того, как AI Overview сгенерировал ложные утверждения, что он был осужден за сексуальное преступление, что привело к отмене концерта.

OpenClawRadar