OpenClaw v2026.3.13 ajoute une configuration de cacheRetention par agent pour réaliser des économies sur les coûts des jetons OpenAI.

✍️ OpenClawRadar📅 Publié: March 14, 2026🔗 Source
OpenClaw v2026.3.13 ajoute une configuration de cacheRetention par agent pour réaliser des économies sur les coûts des jetons OpenAI.
Ad

Quoi de neuf dans la v2026.3.13

La version 2026.3.13 d'OpenClaw a ajouté une validation de configuration appropriée pour params.cacheRetention sur les entrées par agent. Cela vous permet de définir la rétention du cache de manière déclarative dans votre fichier de configuration openclaw.json.

Le problème avec le comportement par défaut du cache

OpenAI prend en charge une rétention prolongée du cache des prompts (24 heures) via prompt_cache_retention: "24h" dans leur API, ce qui conserve le préfixe de votre prompt en cache pendant 24 heures au lieu des 5 à 10 minutes par défaut. Les tokens d'entrée mis en cache sont facturés à 50 % de réduction.

Si vous exécutez des agents sur des cycles de pulsation supérieurs à 10 minutes (ce que la source note comme étant "pratiquement tout le monde"), votre cache se refroidit complètement entre chaque tour. Cela signifie que vous payez le prix fort pour l'ensemble du contexte d'entrée à chaque pulsation.

La source décrit une configuration avec 15 agents sur GPT-5.2 avec des pulsations toutes les 60 à 90 minutes où chaque pulsation était un démarrage à froid garanti. L'invite système, le contexte d'amorçage, HEARTBEAT.md, AGENTS.md, SOUL.md, les définitions d'outils — tout cela était renvoyé au prix fort à chaque cycle car le cache expirait dans l'intervalle entre les pulsations.

Comment le configurer

Vous pouvez maintenant définir la rétention du cache dans votre openclaw.json :

{
  "agents": {
    "list": [
      {
        "agentId": "my-agent",
        "params": {
          "cacheRetention": "long"
        }
      }
    ]
  }
}

La valeur "long" correspond au prompt_cache_retention: "24h" d'OpenAI via la bibliothèque pi-ai.

Ad

Mise en garde importante : correctif d'exécution requis

La fonction resolveCacheRetention() d'OpenClaw comporte une clause de garde qui bloque par défaut les fournisseurs OpenAI. Elle n'autorise que Anthropic et Bedrock. Ainsi, même avec la configuration définie, la valeur est filtrée avant d'atteindre l'API.

Vous avez besoin du correctif d'exécution de l'issue #27515 pour que cela fonctionne. Le correctif ajoute OpenAI à la liste des fournisseurs autorisés dans la clause de garde. Sans la configuration ET le correctif, rien ne se passe.

L'auteur de la source note qu'il avait appliqué le correctif pendant des semaines mais n'avait jamais défini la valeur de configuration — ce qui signifie que le correctif vérifiait extraParams?.cacheRetention !== void 0, obtenait undefined, et bloquait toujours OpenAI. Le correctif ne faisait rien sans la configuration.

Potentiel d'économies

Avec 15 agents effectuant des pulsations, chacun envoyant environ 128K à 170K tokens d'entrée par tour :

  • Sans cache de 24h : 100 % des tokens d'entrée au prix fort, à chaque tour. Le cache meurt dans l'intervalle d'environ 60 à 90 minutes entre les pulsations.
  • Avec cache de 24h : Le préfixe stable (invite système, configuration de l'agent, définitions d'outils — généralement 80 à 90 % de l'entrée) reste en cache entre les pulsations. Ces tokens sont facturés à moitié prix.

Sur un système exécutant 15 agents pendant une journée de travail complète, cela représente des centaines de cycles de pulsation par jour où la majorité des tokens d'entrée passent du prix fort au demi-prix. La réduction des coûts d'entrée s'accumule rapidement.

📖 Lire la source complète : r/openclaw

Ad

👀 See Also

Programmez des IA pour affronter des humains dans un nouveau jeu multijoueur.
Tips

Programmez des IA pour affronter des humains dans un nouveau jeu multijoueur.

Un nouveau jeu multijoueur permet aux joueurs de coder des bots IA pour affronter des joueurs humains en temps réel, offrant un mélange unique de défis de programmation et de jeu.

OpenClawRadar
Rendez OpenClaw plus intelligent : contrez les prémisses erronées avec une compétence de vérification directionnelle
Tips

Rendez OpenClaw plus intelligent : contrez les prémisses erronées avec une compétence de vérification directionnelle

Une nouvelle compétence pour OpenClaw ajoute des directives de qualité de décision à AGENTS.md, obligeant l'agent à remettre en question les hypothèses de l'utilisateur avant d'agir sur des changements coûteux ou irréversibles.

OpenClawRadar
Solution de contournement pour l'erreur de boucle de rétroaction du microphone de l'application mobile Claude
Tips

Solution de contournement pour l'erreur de boucle de rétroaction du microphone de l'application mobile Claude

Un utilisateur de Reddit partage une solution de contournement fonctionnelle pour l'erreur de boucle de rétroaction du microphone dans l'application mobile Claude : installer la version web en tant qu'application web progressive autonome via Google Chrome, ce qui contourne le problème et permet d'accéder à différents modèles Claude.

OpenClawRadar
Mode de défaillance du "singe blanc" : Comment les agents persistants restent bloqués sur des faits erronés
Tips

Mode de défaillance du "singe blanc" : Comment les agents persistants restent bloqués sur des faits erronés

Une étude multi-architecture de la 'contamination du substrat de reconstruction' — où des faits erronés dans les fichiers d'état de veille se répliquent entre sessions. Inclut un sondage en 6 questions pour les agents persistants.

OpenClawRadar