Диагностика кэша подсказок Claude: анализ статистики показывает 98,9% коэффициент чтения из кэша

✍️ OpenClawRadar📅 Опубликовано: 20 мая 2026 г.🔗 Source
Диагностика кэша подсказок Claude: анализ статистики показывает 98,9% коэффициент чтения из кэша
Ad

Два дня назад Anthropic выпустила функцию диагностики кэша промптов в Claude Console. Это инструмент для разработчиков, позволяющий понять, почему запрос не попадает в кэш, и снизить затраты. Один разработчик (u/samuelroy_) поделился своей статистикой в ветке сообщества, стремясь найти закономерности и улучшить производительность кэша в целом.

Ключевая статистика из источника

  • Общий коэффициент попаданий в кэш: 98,9%
  • 80% промахов кэша связаны с messages changed.
  • Амортизация записи для Sonnet: 3,69x

Разработчик отметил, что его проект спроектирован так, чтобы только добавлять сообщения в историю, поэтому высокая доля промахов из-за messages changed оказалась неожиданной. Вероятное объяснение — пользователи разветвляют беседы, что изменяет цепочку сообщений.

Ad

Что это значит

Кэширование промптов снижает стоимость и задержку. При коэффициенте попаданий 98,9% разработчик уже эффективен, но диагностические данные показывают четкую область для улучшения: уменьшение ненужных изменений сообщений. Если вы видите похожие паттерны, аудит того, как разветвляются или редактируются беседы, может повысить коэффициент попаданий в кэш.

Для справки: амортизация записи (3,69x для Sonnet) показывает, сколько раз запись кэша выполняется относительно чтений. Меньшее значение — лучше.

Такая аналитика от первого лица — шаг вперед в оптимизации затрат на AI API. Ожидается, что другие провайдеры последуют этому примеру.

📖 Читать полный источник: r/ClaudeAI

Ad

👀 Смотрите также

Token Efficiency как акт отказа: Почему AI-компании хотят, чтобы вы были расточительны
Новости

Token Efficiency как акт отказа: Почему AI-компании хотят, чтобы вы были расточительны

Поставщики LLM наживаются на зависимости. Эффективность использования токенов — это акт отказа. Не генерируйте то, что не будете читать.

OpenClawRadar
Протокол Конвергенции Quumble v5: Результаты эксперимента с кросс-архитектурными LLM
Новости

Протокол Конвергенции Quumble v5: Результаты эксперимента с кросс-архитектурными LLM

Протокол конвергенции Quumble v5 проверяет, сходятся ли независимые экземпляры LLM в описаниях воображаемых существ при получении бессмысленных слов. Результаты показывают, что как Claude (Opus 4.6 и Sonnet 4.6), так и GPT-5.3 независимо друг от друга создали маленькое, круглое, мягкое, лавандового оттенка, биолюминесцентное существо, которое жужжит, исходя из слова 'quumble'.

OpenClawRadar
Утечка исходного кода CLI Claude Code раскрывает скрытые функции и внутренние флаги.
Новости

Утечка исходного кода CLI Claude Code раскрывает скрытые функции и внутренние флаги.

Анализ утекшего исходного кода TypeScript для Claude Code CLI выявил 35 флагов функций, активируемых при сборке, включая AI-питомцев BUDDY, постоянную память KAIROS, удалённое планирование ULTRAPLAN и режим координатора. Также обнаружено более 120 недокументированных переменных окружения и 26 внутренних слеш-команд.

OpenClawRadar
Claude теперь подключается к Adobe Creative Cloud, Blender, Ableton и другим
Новости

Claude теперь подключается к Adobe Creative Cloud, Blender, Ableton и другим

Anthropic выпускает коннекторы для Claude, позволяющие интегрироваться с Adobe Creative Cloud, Affinity, Blender, Ableton, Splice и Autodesk, чтобы управлять приложениями и получать данные с помощью естественного языка.

OpenClawRadar