TREX : le réviseur de code IA de Greptile qui exécute votre code

Greptile a lancé TREX (Test, Run, Execute), une couche d'exécution qui exécute votre code lors de la revue de code assistée par IA. Au lieu de simplement lire les diffs, TREX exécute réellement le code modifié et remonte les bugs d'exécution — régressions UI, erreurs logiques dépendantes de l'état, conditions de concurrence — que l'analyse statique ne peut pas détecter.
Architecture : Orchestrateur + Sous-agents par problème
Les premières versions utilisaient des agents séparés ou un seul agent combiné. Les deux ont échoué : les agents séparés dupliquaient le travail sans contexte partagé ; un seul agent était surchargé à gérer la configuration, les captures d'écran et les tests. La solution a été un agent orchestrateur (le relecteur principal de Greptile) qui lit le diff, identifie les problèmes suspects et lance un sous-agent TREX dédié par problème, tous exécutés en parallèle. Chaque sous-agent hérite du contexte de l'orchestrateur et dispose de son propre contexte limité à son investigation spécifique.
Exemple : une fonctionnalité UI derrière une porte d'authentification. Un sous-agent configure automatiquement l'environnement, gère l'authentification, active les feature flags et retourne une capture d'écran de la fonctionnalité rendue.
Artéfacts multimodaux vs. points de liste
Les premiers résultats de TREX étaient des résumés en points de liste — mais les points de liste permettaient des hallucinations (par exemple, prétendre qu'un test avait réussi alors que non) et ne permettaient pas de vérification. La solution : chaque résultat TREX est appuyé par un ensemble d'artéfacts multimodaux : captures d'écran, logs d'exécution, traces API et scripts d'exécution. Chaque modalité raconte une partie de l'histoire, permettant de retracer exactement ce qui s'est passé. Le premier artéfact qui a impressionné l'équipe était une vidéo d'un changement d'animation — montrant l'effet réel à l'exécution.
Ce qu'il détecte
TREX cible les bugs qui n'apparaissent pas dans les diffs de code : erreurs logiques nécessitant des séquences d'état spécifiques, régressions UI après chargement de page, et conditions de concurrence nécessitant de vraies requêtes. Il génère et exécute des tests, mais l'accent est mis sur la recherche de bugs, pas seulement sur l'écriture de tests. Le sous-agent détermine lui-même la configuration.
Comme le dit Shlok Mehrotra, l'ingénieur derrière TREX : « On peut lire le diff parfaitement et quand même passer complètement à côté de ces types de bugs. »
📖 Lire la source complète : HN AI Agents
👀 See Also

Claude Code Studio : Application de bureau open-source pour gérer plusieurs sessions de codage Claude
Claude Code Studio v0.9.3 est une application de bureau open-source qui fournit une interface multi-fenêtres pour gérer plusieurs sessions CLI Claude Code. Il résout les problèmes courants de flux de travail comme jongler avec les onglets de terminal, la persistance des sessions et la répétition des instructions.

Construire un langage de programmation avec Claude Code : l'expérience Cutlet
Ankur Sethi a construit un langage de programmation complet appelé Cutlet en utilisant Claude Code sur quatre semaines, l'IA générant chaque ligne de code pendant qu'il se concentrait sur les garde-fous et les tests. Le langage propose un typage dynamique, des opérations vectorisées et un REPL, fonctionnant sur macOS et Linux.

Assistant IA WhatsApp Construit avec Claude Code en Alternative à OpenClaw
Un développeur a créé un assistant IA WhatsApp en utilisant Claude Code comme cerveau agentique, avec un serveur relais local pour les webhooks WhatsApp et un serveur MCP pour la connexion. Le projet inclut Arcade pour l'authentification ciblée vers Google Calendar, Gmail et Slack.

Exécuter OpenClaw dans une Micro-VM Isolée avec Void-Box
OpenClaw peut être exécuté en tant que service au sein d'une micro-machine virtuelle isolée en utilisant Void-Box, un runtime à capacités limitées qui exécute des workflows dans des micro-machines virtuelles KVM, offrant une limite d'exécution propre sans intervention de runtime de conteneur.