Culpa : Moteur de relecture déterministe open source pour le débogage d'agents IA

✍️ OpenClawRadar📅 Publié: April 20, 2026🔗 Source
Culpa : Moteur de relecture déterministe open source pour le débogage d'agents IA
Ad

Culpa est un moteur de relecture déterministe open source conçu spécifiquement pour le débogage des sessions d'agents d'IA. Le problème central qu'il résout est la nature non déterministe des agents LLM—lorsqu'ils échouent, vous ne pouvez pas reproduire l'échec exact en relançant simplement la session.

Comment cela fonctionne

L'outil enregistre chaque appel LLM ainsi que le contexte d'exécution complet pendant une session d'agent. Lorsque vous devez déboguer un échec, il relit la session en utilisant les réponses enregistrées comme substituts au lieu d'effectuer de nouveaux appels API. Cela rend la relecture entièrement déterministe et ne coûte rien puisqu'elle n'accède pas aux véritables API.

Fonctionnalités clés

  • Mode Proxy: Fonctionne avec des outils comme Claude Code et Cursor sans nécessiter de modifications de code
  • SDK Python: Disponible pour les développeurs créant leurs propres agents
  • Support API: Compatible avec les API Anthropic et OpenAI
  • Capacité de bifurcation: Vous pouvez bifurquer à n'importe quel point de décision enregistré, injecter une réponse différente et voir ce qui se serait passé
Ad

Avantages pratiques

Puisque la relecture utilise des réponses enregistrées au lieu d'effectuer de véritables appels API, les sessions de débogage n'engendrent aucun coût API. La nature déterministe des relectures permet de reproduire et d'analyser de manière fiable des échecs qui seraient autrement impossibles à recréer en raison du caractère aléatoire inhérent des réponses LLM.

Le projet recherche activement des retours, en particulier de la part des développeurs créant des flux de travail d'agents. Le créateur note qu'il est étudiant en première année d'informatique et cherche à améliorer l'outil.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Mneme : un accrochage PreToolUse qui bloque les modifications de Claude Code violant les décisions architecturales
Tools

Mneme : un accrochage PreToolUse qui bloque les modifications de Claude Code violant les décisions architecturales

Mneme est un hook PreToolUse pour Claude Code qui vérifie chaque édition/écriture/multi-édition par rapport à un fichier de décisions local avant toute écriture sur disque, bloquant les violations sans intervention manuelle.

OpenClawRadar
JetBrains présente un plugin pour le code Go moderne avec les agents IA Junie et Claude Code
Tools

JetBrains présente un plugin pour le code Go moderne avec les agents IA Junie et Claude Code

JetBrains a publié un plugin pour les agents d'IA Junie et Claude Code, améliorant leur capacité à générer du code Go moderne en respectant les dernières fonctionnalités et bonnes pratiques de Go.

OpenClawRadar
Manifest Router ajoute la prise en charge des abonnements ZAI pour la gestion des modèles OpenClaw
Tools

Manifest Router ajoute la prise en charge des abonnements ZAI pour la gestion des modèles OpenClaw

Le routeur Manifest prend désormais en charge les abonnements ZAI, permettant à tous les modèles ZAI d'apparaître dans les niveaux de routage avec une sélection automatique de modèle par requête. L'outil est en version bêta, gratuit, open source, et inclut un tableau de bord pour suivre les coûts par agent, message et modèle.

OpenClawRadar
Android CLI et Compétences pour les Flux de Travail de Développement d'Agents IA
Tools

Android CLI et Compétences pour les Flux de Travail de Développement d'Agents IA

Google a lancé Android CLI avec des commandes comme android create et android sdk install, ainsi que le dépôt GitHub Android Skills avec des ensembles d'instructions modulaires. Les benchmarks internes montrent une réduction de 70 % de l'utilisation de tokens LLM et une exécution des tâches 3 fois plus rapide.

OpenClawRadar