Диагностика кэша подсказок Claude: анализ статистики показывает 98,9% коэффициент чтения из кэша

Два дня назад Anthropic выпустила функцию диагностики кэша промптов в Claude Console. Это инструмент для разработчиков, позволяющий понять, почему запрос не попадает в кэш, и снизить затраты. Один разработчик (u/samuelroy_) поделился своей статистикой в ветке сообщества, стремясь найти закономерности и улучшить производительность кэша в целом.
Ключевая статистика из источника
- Общий коэффициент попаданий в кэш: 98,9%
- 80% промахов кэша связаны с
messages changed. - Амортизация записи для Sonnet: 3,69x
Разработчик отметил, что его проект спроектирован так, чтобы только добавлять сообщения в историю, поэтому высокая доля промахов из-за messages changed оказалась неожиданной. Вероятное объяснение — пользователи разветвляют беседы, что изменяет цепочку сообщений.
Что это значит
Кэширование промптов снижает стоимость и задержку. При коэффициенте попаданий 98,9% разработчик уже эффективен, но диагностические данные показывают четкую область для улучшения: уменьшение ненужных изменений сообщений. Если вы видите похожие паттерны, аудит того, как разветвляются или редактируются беседы, может повысить коэффициент попаданий в кэш.
Для справки: амортизация записи (3,69x для Sonnet) показывает, сколько раз запись кэша выполняется относительно чтений. Меньшее значение — лучше.
Такая аналитика от первого лица — шаг вперед в оптимизации затрат на AI API. Ожидается, что другие провайдеры последуют этому примеру.
📖 Читать полный источник: r/ClaudeAI
👀 Смотрите также

Token Efficiency как акт отказа: Почему AI-компании хотят, чтобы вы были расточительны
Поставщики LLM наживаются на зависимости. Эффективность использования токенов — это акт отказа. Не генерируйте то, что не будете читать.

Протокол Конвергенции Quumble v5: Результаты эксперимента с кросс-архитектурными LLM
Протокол конвергенции Quumble v5 проверяет, сходятся ли независимые экземпляры LLM в описаниях воображаемых существ при получении бессмысленных слов. Результаты показывают, что как Claude (Opus 4.6 и Sonnet 4.6), так и GPT-5.3 независимо друг от друга создали маленькое, круглое, мягкое, лавандового оттенка, биолюминесцентное существо, которое жужжит, исходя из слова 'quumble'.

Утечка исходного кода CLI Claude Code раскрывает скрытые функции и внутренние флаги.
Анализ утекшего исходного кода TypeScript для Claude Code CLI выявил 35 флагов функций, активируемых при сборке, включая AI-питомцев BUDDY, постоянную память KAIROS, удалённое планирование ULTRAPLAN и режим координатора. Также обнаружено более 120 недокументированных переменных окружения и 26 внутренних слеш-команд.

Claude теперь подключается к Adobe Creative Cloud, Blender, Ableton и другим
Anthropic выпускает коннекторы для Claude, позволяющие интегрироваться с Adobe Creative Cloud, Affinity, Blender, Ableton, Splice и Autodesk, чтобы управлять приложениями и получать данные с помощью естественного языка.