TREX: El revisor de código AI de Greptile que ejecuta tu código

Greptile lanzó TREX (Test, Run, Execute), una capa de ejecución que ejecuta tu código durante la revisión de código con IA. En lugar de solo leer diferencias, TREX ejecuta el código modificado y saca a la luz errores de ejecución — regresiones de UI, errores lógicos dependientes del estado, condiciones de carrera — que el análisis estático no puede detectar.
Arquitectura: Orquestador + Subagentes por Problema
Las primeras versiones probaron agentes separados o un solo agente combinado. Ambos fallaron: los agentes separados duplicaban trabajo sin contexto compartido; un solo agente se sobrecargaba gestionando configuración, capturas de pantalla y pruebas. La solución fue un agente orquestador (el revisor principal de Greptile) que lee el diff, identifica problemas sospechosos y lanza un subagente TREX dedicado por problema, todos ejecutándose en paralelo. Cada subagente hereda el contexto del orquestador y tiene su propia ventana de contexto limitada a su investigación específica.
Ejemplo: una funcionalidad de UI detrás de una puerta de autenticación. Un subagente configura el entorno de forma autónoma, maneja la autenticación, activa banderas de funcionalidad y devuelve una captura de pantalla de la funcionalidad renderizada.
Artefactos Multimodales vs. Viñetas
Inicialmente, la salida de TREX consistía en resúmenes con viñetas — pero las viñetas permitían alucinaciones (por ejemplo, afirmar que una prueba pasó cuando no lo hizo) y no daban forma de verificar. La solución: cada hallazgo de TREX está respaldado por un conjunto de artefactos multimodales: capturas de pantalla, registros de ejecución, trazas de API y scripts de ejecución. Cada modalidad cuenta parte de la historia, haciendo posible rastrear exactamente lo que ocurrió. El primer artefacto que impresionó al equipo fue una captura de video de un cambio de animación, mostrando el efecto real en tiempo de ejecución.
Qué Detecta
TREX se enfoca en errores que no aparecen en los diffs de código: errores lógicos que requieren secuencias de estado específicas, regresiones de UI después de cargar la página, y condiciones de carrera que necesitan solicitudes reales. Genera y ejecuta pruebas, pero el objetivo es encontrar errores, no solo escribir pruebas. El subagente descubre la configuración por sí mismo.
Como dice Shlok Mehrotra, el ingeniero detrás de TREX: "Puedes leer el diff perfectamente y aún así perderte completamente este tipo de errores."
📖 Lea la fuente completa: HN AI Agents
👀 Ver también

Puente IDE de Claude de Código Abierto Conecta Dispatch, Aplicación de Escritorio y Claude Code
El claude-ide-bridge es una herramienta de código abierto con licencia MIT que conecta Claude Code a tu IDE, proporcionando acceso a LSP, depurador, terminales, git y GitHub a través de 124 herramientas. Permite un flujo de trabajo donde las tareas enviadas mediante Dispatch desde un teléfono son manejadas por la aplicación de escritorio de Claude, que usa Claude Code para escribir código y ejecutar pruebas mientras interactúa con el IDE.

Claude Counter: La aplicación de Android rastrea los límites de uso de Claude con notificaciones en tiempo real
Un desarrollador creó Claude Counter, una aplicación gratuita para Android que consulta la API de Claude para mostrar los límites de sesión y uso semanal en tiempo real. La aplicación muestra barras de progreso, proporciona notificaciones detalladas con el porcentaje restante y alerta cuando los límites se reinician.

Memoria de Papilas Gustativas: Memoria de Agente Reversible mediante Vectores de Cómputo Hiperdimensional
La computación hiperdimensional reemplaza la búsqueda vectorial para un recuerdo completo: lista TODOS los días que tocan un proyecto, detecta flujos de trabajo sin nombre y descompone registros diarios sin pérdida mediante productos punto.

SendToAI Extensión de VS Code Resuelve el Límite de 20 Archivos de Claude con Agrupación de Proyectos
SendToAI es una extensión gratuita de VS Code que empaqueta proyectos completos en un solo pegado del portapapeles, evitando el límite de 20 archivos de Claude. Incluye selección visual de archivos, conteo de tokens, estimaciones de costos y notas de proyecto que persisten entre sesiones.