OpenClaw v2026.3.13 добавляет настройку cacheRetention для каждого агента для экономии затрат на токены OpenAI.

✍️ OpenClawRadar📅 Опубликовано: 14 марта 2026 г.🔗 Source
OpenClaw v2026.3.13 добавляет настройку cacheRetention для каждого агента для экономии затрат на токены OpenAI.
Ad

Что изменилось в v2026.3.13

Версия OpenClaw 2026.3.13 добавила правильную валидацию конфигурации для params.cacheRetention в записях каждого агента. Это позволяет вам устанавливать срок хранения кэша декларативно в вашем файле конфигурации openclaw.json.

Проблема с поведением кэша по умолчанию

OpenAI поддерживает расширенное хранение кэша промптов (24 часа) через параметр prompt_cache_retention: "24h" в их API, что сохраняет префикс вашего промпта в кэше в течение 24 часов вместо стандартных 5-10 минут. Кэшированные входные токены тарифицируются со скидкой 50%.

Если вы запускаете агенты с циклами heartbeat дольше 10 минут (что, как отмечает источник, относится к "практически всем"), ваш кэш полностью остывает между каждым циклом. Это означает, что вы платите полную цену за весь входной контекст при каждом heartbeat.

В источнике описывается настройка с 15 агентами на GPT-5.2 с heartbeat каждые 60-90 минут, где каждый heartbeat гарантированно был холодным стартом. Системный промпт, начальный контекст, HEARTBEAT.md, AGENTS.md, SOUL.md, определения инструментов — всё это пересылалось по полной цене каждый цикл, потому что кэш истекал в промежутке между heartbeat.

Как настроить

Теперь вы можете установить срок хранения кэша в вашем openclaw.json:

{
  "agents": {
    "list": [
      {
        "agentId": "my-agent",
        "params": {
          "cacheRetention": "long"
        }
      }
    ]
  }
}

Значение "long" соответствует параметру OpenAI prompt_cache_retention: "24h" через библиотеку pi-ai.

Ad

Важное предостережение: требуется патч времени выполнения

Функция resolveCacheRetention() в OpenClaw имеет защитную оговорку, которая по умолчанию блокирует провайдеров OpenAI. Она пропускает только Anthropic и Bedrock. Поэтому даже с установленной конфигурацией значение фильтруется до того, как достигнет API.

Вам нужен патч времени выполнения из issue #27515, чтобы это заработало. Патч добавляет OpenAI в список разрешённых провайдеров в защитной оговорке. Без конфигурации И патча ничего не произойдёт.

Автор источника отмечает, что у них патч был применён неделями, но значение конфигурации не было установлено — это означает, что патч проверял extraParams?.cacheRetention !== void 0, получал undefined и всё равно блокировал OpenAI. Патч ничего не делал без конфигурации.

Потенциал экономии затрат

При 15 агентах с heartbeat, каждый из которых отправляет ~128K-170K входных токенов за цикл:

  • Без 24-часового кэша: 100% входных токенов по полной цене, каждый цикл. Кэш умирает в промежутке ~60-90 минут между heartbeat.
  • С 24-часовым кэшем: Стабильный префикс (системный промпт, конфигурация агента, определения инструментов — обычно 80-90% ввода) остаётся в кэше между heartbeat. Эти токены тарифицируются по половинной цене.

В системе с 15 агентами, работающей полный рабочий день, это сотни циклов heartbeat в день, где основная масса входных токенов переходит с полной цены на половинную. Снижение затрат на ввод быстро накапливается.

📖 Read the full source: r/openclaw

Ad

👀 Смотрите также

Аннотационно-управляемый интерфейс: как проектировать шаблоны в Figma и позволить Claude извлекать координаты
Советы

Аннотационно-управляемый интерфейс: как проектировать шаблоны в Figma и позволить Claude извлекать координаты

Пропустите создание собственного движка макетов: рисуйте плоские PNG в Figma, закрашивайте прямоугольники для слотов, отдайте оба файла Claude и получите редактируемые области с координатами и областями касания. Один день вместо недель.

OpenClawRadar
Исследовательские результаты Claude варьируются в зависимости от языка: один запрос, разные источники
Советы

Исследовательские результаты Claude варьируются в зависимости от языка: один запрос, разные источники

Тест Reddit показывает, что Claude возвращает разные источники и события на английском, китайском, русском, испанском и хинди — одна и та же модель, одинаковая структура, разные результаты.

OpenClawRadar
Улучшение OpenClaw с помощью локальной LLM: представляем GLM-4.7-Flash
Советы

Улучшение OpenClaw с помощью локальной LLM: представляем GLM-4.7-Flash

Интеграция GLM-4.7-Flash с OpenClaw революционизирует автоматизацию ИИ, позволяя бесперебойное локальное развертывание и сложное выполнение кода.

OpenClawRadar
5 неочевидных навыков агента для фронтенд-разработчиков, использующих Claude AI
Советы

5 неочевидных навыков агента для фронтенд-разработчиков, использующих Claude AI

Фронтенд-разработчик делится 5 специфическими навыками для агентов Claude AI, которые повышают продуктивность и качество кода: Playwright, продвинутые типы для TypeScript, LyteNyte Grid, шаблоны Tailwind CSS и навыки PNPM.

OpenClawRadar