CAL : Couche d'Optimisation de Contexte Open-Source pour Agents LLM

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
CAL : Couche d'Optimisation de Contexte Open-Source pour Agents LLM
Ad

Ce que fait CAL

CAL est une bibliothèque Python qui s'intercale entre votre code existant et les appels d'API LLM, sélectionnant, compressant et assemblant intelligemment le contexte pour chaque requête. Elle répond aux problèmes de coût et de contexte dans les configurations d'agents gourmands en tokens, particulièrement pertinents avec les récents changements d'abonnement Claude Pro/Max.

Performances de référence

En production avec Claude Opus 4 et 103 morceaux de contexte :

  • Sans CAL : Chaque requête envoie les 103 morceaux (~23 000 tokens) à 0,043 $ par requête
  • Avec CAL : Réduit à ~6 morceaux et 4 100 tokens à 0,008 $ par requête
  • Résultats : Réduction de 83 % des tokens, réduction de 81 % du coût

Validé sur 5 000 invites WildChat (un jeu de données académique ouvert de conversations réelles d'LLM dans 57 langues) avec une économie moyenne de 97,6 %.

Fonctionnalités clés

  • Sélecteur : Un score pondéré par IDF sélectionne uniquement les morceaux pertinents par requête. Utilise un préfixe stable + des morceaux dynamiques sélectionnés par requête.
  • Ébauches d'outils : Chargement paresseux à trois niveaux avec des ébauches légères jusqu'à ce que le modèle signale l'intention d'utiliser un outil spécifique.
  • Moteur de coût : Calculateur d'économies conscient du fournisseur qui connaît les 4 niveaux d'entrée d'Anthropic et les tarifs de stockage en cache de Google.
  • Suppression du bruit : Seuil IDF + portes "require-any" pour empêcher les mots courants de charger des morceaux non pertinents à chaque requête.
  • Ordonnancement stable pour le cache : Utilise les scores uniquement pour la sélection, puis l'ordre alphabétique pour la position afin de maintenir les succès de cache.
Ad

Détails techniques

Gestion du contexte multi-tours : Les ébauches d'outils sont conscientes de l'historique. Si le modèle a utilisé un outil dans un tour précédent, le schéma complet reste chargé pour maintenir la continuité de la conversation.

Support des fournisseurs : CAL est agnostique des fournisseurs et fonctionne avec tout fournisseur ayant un point de terminaison de complétion de chat. Le moteur de coût gère déjà les 4 niveaux d'entrée d'Anthropic et les tarifs de stockage en cache de Google.

Cas limites : Utilise des seuils IDF et une suppression du bruit pour les requêtes ambiguës. Un score hybride mot-clé+sémantique est prévu.

Installation et licence

pip install cal-context

Sous licence MIT. PyPI : https://pypi.org/project/cal-context/

GitHub : https://github.com/vjc-lab/context-assembly-layer

📖 Read the full source: r/openclaw

Ad

👀 See Also

Serveur MCP Ultrahuman Ring non officiel pour l'intégration d'agents IA
Tools

Serveur MCP Ultrahuman Ring non officiel pour l'intégration d'agents IA

Un serveur MCP développé par la communauté encapsule l'API Partenaire Ultrahuman, permettant aux agents d'IA de codage d'accéder directement aux métriques de l'anneau et du MCG comme le sommeil, la VRC, le glucose et les scores de récupération via des appels de données structurées.

OpenClawRadar
L'outil GrapeRoot réduit les coûts de Claude Code de 45 % grâce à un contexte de référentiel pré-analysé.
Tools

L'outil GrapeRoot réduit les coûts de Claude Code de 45 % grâce à un contexte de référentiel pré-analysé.

Un outil gratuit appelé GrapeRoot qui pré-analyse les dépôts et construit des graphes de dépendances a réduit les coûts de Claude Code de 45 % en moyenne sur 10 tâches d'ingénierie tout en améliorant la qualité des réponses de 13 %. L'outil élimine les boucles d'exploration qui consomment normalement des tokens.

OpenClawRadar
Plugin OpenClaw Memos Résout les Problèmes de Transfert de Mémoire dans les Agents de Codage IA
Tools

Plugin OpenClaw Memos Résout les Problèmes de Transfert de Mémoire dans les Agents de Codage IA

Un utilisateur de Reddit explique comment la fuite du code de Claude a mis en lumière les problèmes de transfert de mémoire dans les agents d'IA de codage, où des transcriptions gonflées causent des problèmes lors du changement de modèle. Ils ont implémenté le plugin memos dans OpenClaw avec une stratégie de rappel sélectif pour compresser les travaux récents et éliminer les appels d'outils obsolètes.

OpenClawRadar
Pourquoi un outil run() unique avec des commandes Unix surpasse l'appel de fonctions pour les agents IA
Tools

Pourquoi un outil run() unique avec des commandes Unix surpasse l'appel de fonctions pour les agents IA

Un responsable backend avec deux ans d'expérience dans la création d'agents affirme qu'un outil unique run(command="...") avec des commandes CLI de style Unix surpasse les catalogues traditionnels d'appels de fonctions. Cette approche exploite la familiarité préexistante des LLM avec les commandes shell dans leurs données d'entraînement.

OpenClawRadar