Les journaux de session de l'agent de codage sont stockés localement, ce qui pourrait permettre un entraînement fédéré ouvert.

✍️ OpenClawRadar📅 Publié: February 25, 2026🔗 Source
Les journaux de session de l'agent de codage sont stockés localement, ce qui pourrait permettre un entraînement fédéré ouvert.
Ad

Lorsque vous utilisez des agents de codage comme Claude Code ou Codex CLI en mode agent, ils enregistrent localement sur votre machine des données de session complètes. Ces journaux capturent la boucle d'interaction complète : votre tâche initiale, le processus de raisonnement du modèle, chaque appel d'outil effectué, chaque réponse de l'environnement, chaque erreur rencontrée et chaque nouvelle tentative. Cela crée des tuples complets (état → action → récompense → état suivant) — le format exact de données dont les chercheurs en apprentissage par renforcement ont besoin.

Ce que contiennent les journaux

L'auteur de la source a vérifié ses propres machines et a trouvé :

  • Mac Mini : ~/.claude/projects/ contenant 3,1 Go répartis sur 1103 fichiers provenant de 574 sessions agentiques
  • MacBook : ~/.codex/sessions/ contenant 2,4 Go répartis sur 3530 fichiers provenant de 79 sessions agentiques
  • MacBook : ~/.claude/projects/ contenant 652 Mo répartis sur 316 fichiers provenant de 99 sessions agentiques

Au total, ils ont identifié 775 sessions avec de vrais appels d'outils contenant environ 41 millions de tokens. Extrapolé à des milliers de développeurs, cela pourrait représenter des centaines de milliards de tokens de données de trajectoire agentique réelles — des données qui n'ont actuellement aucun équivalent ouvert comme le jeu de données The Pile.

Pourquoi ces données sont importantes

L'environnement fournit des signaux de retour clairs : code de sortie 0 ou non, tests réussis ou non. Cela offre le signal d'entraînement manquant pour le raisonnement causal, la récupération d'erreurs et la planification à long terme — des domaines où les modèles actuels ont des difficultés. Les grands laboratoires d'IA collectent déjà ces données en interne pour entraîner leurs modèles propriétaires, mais il n'y a pas d'équivalent ouvert car les données sont fragmentées sur les machines individuelles des développeurs.

Ad

La proposition : L'apprentissage fédéré

Le post propose d'utiliser l'apprentissage fédéré où vos données ne quittent jamais votre machine. Vous entraîneriez un petit adaptateur LoRA localement, partageriez uniquement les poids avec du bruit de confidentialité différentielle ajouté, et recevriez en retour un modèle global amélioré. Chacun contribue au calcul et au signal sans exposer ses données brutes. Alternativement, la communauté pourrait anonymiser les données pour créer un jeu de données pour affiner les modèles.

Étapes pratiques

Pour conserver vos journaux (Claude Code les supprime après 30 jours par défaut) :

echo '{"cleanupPeriodDays": 36500}' > ~/.claude/settings.json

Pour vérifier ce qui se trouve sur vos propres machines :

du -sh ~/.codex/sessions/ 2>/dev/null
du -sh ~/.claude/projects/ 2>/dev/null
find ~/.codex/sessions/ -name "*.jsonl" | wc -l
find ~/.claude/projects/ -name "*.jsonl" | wc -l

Le post Reddit encourage les développeurs à partager leurs chiffres dans les commentaires pour évaluer l'échelle réelle des données inutilisées dans la communauté, avec pour objectif de construire un équivalent ouvert s'il y a suffisamment d'intérêt.

📖 Lire la source complète : r/LocalLLaMA

Ad

👀 See Also

Anthropic sépare le contrôle à distance des agents en Dispatch et Contrôle à distance, avec des problèmes de fiabilité
News

Anthropic sépare le contrôle à distance des agents en Dispatch et Contrôle à distance, avec des problèmes de fiabilité

Anthropic a mis en œuvre la capacité principale d'OpenClaw sous la forme de deux produits distincts : Dispatch pour les utilisateurs de Cowork et Remote Control pour les développeurs de Claude Code. Les deux souffrent de problèmes de fiabilité, notamment des déconnexions mobiles après environ 10 heures.

OpenClawRadar
Claude Opus 4.8 publié : mode rapide plus rapide et moins cher, workflows dynamiques et améliorations de l'honnêteté
News

Claude Opus 4.8 publié : mode rapide plus rapide et moins cher, workflows dynamiques et améliorations de l'honnêteté

Anthropic met à jour Claude Opus en version 4.8 avec des améliorations de performance, des workflows dynamiques dans Claude Code, un mode rapide 2,5x plus rapide à un prix 3x inférieur, et un entraînement à l'honnêteté.

OpenClawRadar
Claude Code Auto Mode devient la norme par défaut : pourquoi Anthropic a cessé de faire confiance aux humains
News

Claude Code Auto Mode devient la norme par défaut : pourquoi Anthropic a cessé de faire confiance aux humains

Le mode Auto de Claude Code, qui exécute des tâches d'agent avec une intervention humaine minimale, devient la valeur par défaut, car on pense que la supervision humaine ralentit les flux de travail et introduit des erreurs.

OpenClawRadar
Explorer n8n comme alternative aux compétences OpenClaw pour l'automatisation
News

Explorer n8n comme alternative aux compétences OpenClaw pour l'automatisation

La communauté OpenClaw sur Reddit débat des avantages et inconvénients de l'utilisation de n8n par rapport aux compétences OpenClaw pour les tâches d'automatisation. Les points clés de discussion incluent la facilité d'utilisation, la flexibilité et des exemples d'applications concrètes.

OpenClawRadar