Rudel : Analytique open-source pour les sessions Claude Code

Rudel est une couche d'analyse open-source pour les sessions Claude Code qui offre une visibilité sur la façon dont les développeurs utilisent réellement les agents d'IA de codage. L'équipe l'a créé après avoir réalisé qu'elle n'avait aucune vision de ses propres modèles d'utilisation de Claude Code.
Principales découvertes à partir de 1 573 sessions réelles
L'équipe a analysé 1 573 sessions Claude Code contenant plus de 15 millions de tokens et plus de 270 000 interactions. Quelques découvertes notables :
- Les compétences n'étaient utilisées que dans 4 % des sessions
- 26 % des sessions sont abandonnées, la plupart dans les premières 60 secondes
- Le taux de réussite des sessions varie significativement selon le type de tâche (la documentation obtient le score le plus élevé, le refactoring le plus bas)
- Les modèles de cascade d'erreurs apparaissent dans les 2 premières minutes et prédisent l'abandon avec une précision raisonnable
- Il n'existe pas de référence significative pour une performance 'bonne' de session agentique
Comment fonctionne Rudel
L'outil se compose d'une CLI et d'un tableau de bord. Pour commencer :
npm install -g rudel
rudel login # s'authentifier via votre navigateur
rudel enable # téléchargement automatique des sessions à la fin de Claude Code
Pour le téléchargement par lots des sessions existantes :
rudel upload # sélecteur interactif pour le téléchargement par lots
Implémentation technique
Lorsque vous exécutez rudel enable, cela enregistre un hook Claude Code qui s'exécute lorsqu'une session se termine. Le hook télécharge la transcription de la session vers Rudel. Les transcriptions sont stockées dans ClickHouse et traitées en analyses.
Données collectées
Chaque session téléchargée inclut :
- ID de session et horodatages (début, dernière interaction)
- ID utilisateur et ID organisation
- Chemin du projet et nom du package
- Contexte Git (dépôt, branche, SHA, distant)
- Transcription de session (contenu complet des prompts et réponses)
- Utilisation des sous-agents
Considérations de sécurité
Rudel ingère des données complètes de session d'agent de codage, qui peuvent contenir du matériel sensible incluant du code source, des prompts, des sorties d'outils, des contenus de fichiers, des sorties de commandes, des URLs et des secrets. L'équipe insiste sur le fait de n'activer Rudel que sur des projets et environnements où vous êtes à l'aise de télécharger ces données. Pour le service hébergé sur app.rudel.ai, ils déclarent ne pas avoir accès aux données personnelles contenues dans les transcriptions téléchargées.
Développement et auto-hébergement
Le projet est sous licence MIT et inclut une documentation pour le développement local et l'auto-hébergement. Consultez CONTRIBUTING.md pour la configuration locale et docs/self-hosting.md pour exécuter votre propre instance.
Ce type d'outil est particulièrement utile pour les équipes souhaitant comprendre comment leurs développeurs interagissent avec les assistants d'IA de codage, identifier des modèles dans les sessions réussies vs abandonnées, et potentiellement améliorer leurs flux de travail basés sur des données plutôt que sur des anecdotes.
📖 Read the full source: HN AI Agents
👀 See Also

Compétence Agent Wake pour OpenClaw : Notifier Discord lors de l'achèvement des tâches
Un développeur a créé agent-wake.py, un script Python que Claude Code appelle après la fin des tâches. Il envoie des notifications Discord et déclenche des événements de réveil via l'API HTTP de la passerelle, incitant l'agent à publier automatiquement des résumés.

OpenClaw met en œuvre la Compression de l'Historique des Agents pour réduire l'utilisation du contexte.
OpenClaw compresse désormais l'historique des agents en remplaçant les journaux de sous-tâches terminées par des résumés structurés, réduisant environ 1 million de tokens à environ 30 000. Le système utilise un scanner à 4 passes pour identifier les cycles de vie des tâches et génère des résumés masqués qui maintiennent la compatibilité avec les agents.

SWE-CI : Nouveaux tests de référence évaluent les agents d'IA sur la maintenance à long terme du code via l'IC
SWE-CI est un benchmark au niveau du dépôt qui évalue les agents alimentés par des LLM sur la maintenance des bases de code à travers des cycles d'intégration continue, déplaçant l'attention de la correction statique des bogues vers la maintenabilité à long terme sur 100 tâches du monde réel.

La bifurcation vllm-mlx ajoute l'appel d'outils et le cache de prompts pour les agents d'IA de codage locaux.
Un développeur a modifié vllm-mlx pour corriger les problèmes d'appel d'outils et ajouter la mise en cache des invites, réduisant le TTFT de 28s à 0,3s pour OpenClaw sur Apple Silicon. Le fork prend en charge Qwen3-Coder-Next à 65 tok/s sur M3 Ultra avec un appel de fonction fonctionnel.