TREX: O Revisor de Código com IA da Greptile que Executa Seu Código

✍️ OpenClawRadar📅 Publicado: June 18, 2026🔗 Source
TREX: O Revisor de Código com IA da Greptile que Executa Seu Código
Ad

A Greptile lançou o TREX (Test, Run, Execute), uma camada de execução que roda seu código durante a revisão de código com IA. Em vez de apenas ler diffs, o TREX realmente executa o código alterado e revela bugs de runtime — regressões de UI, erros de lógica dependentes de estado, condições de corrida — que a análise estática não consegue capturar.

Arquitetura: Orquestrador + Subagentes por Problema

Versões iniciais tentaram agentes separados ou um único agente combinado. Ambos falharam: agentes separados duplicavam trabalho sem contexto compartilhado; um único agente ficava sobrecarregado gerenciando setup, screenshots e testes. A solução foi um agente orquestrador (o revisor principal do Greptile) que lê o diff, identifica problemas suspeitos e cria um subagente TREX dedicado por problema, todos rodando em paralelo. Cada subagente herda o contexto do orquestrador e tem sua própria janela de contexto focada na investigação específica.

Exemplo: uma funcionalidade de UI atrás de um gate de autenticação. Um subagente configura o ambiente autonomamente, lida com autenticação, alterna feature flags e retorna um screenshot da funcionalidade renderizada.

Ad

Artefatos Multimodais vs. Tópicos

O output inicial do TREX era resumos em tópicos — mas tópicos permitiam alucinações (por exemplo, afirmar que um teste passou quando não passou) e não davam meio de verificar. A correção: cada descoberta do TREX é apoiada por um conjunto de artefatos multimodais: screenshots, logs de execução, traces de API e scripts de execução. Cada modalidade conta parte da história, tornando possível rastrear exatamente o que aconteceu. O primeiro artefato que impressionou a equipe foi um vídeo capturando uma mudança de animação — mostrando o efeito real em runtime.

O Que Ele Detecta

O TREX tem como alvo bugs que não aparecem em diffs de código: erros de lógica que exigem sequências específicas de estado, regressões de UI após o carregamento da página, e condições de corrida que precisam de requisições reais. Ele gera e executa testes, mas o foco é encontrar bugs, não apenas escrever testes. O subagente descobre o setup por conta própria.

Como Shlok Mehrotra, o engenheiro por trás do TREX, diz: "Você pode ler o diff perfeitamente e ainda assim perder completamente esses tipos de bugs."

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

Hearth: Aplicativo de Chat AI Multiusuário Autohospedado para Residências no OpenClaw
Tools

Hearth: Aplicativo de Chat AI Multiusuário Autohospedado para Residências no OpenClaw

Hearth é um aplicativo de chat de IA doméstico auto-hospedado construído sobre o OpenClaw que fornece contas e conversas separadas para cada membro da família, com recursos incluindo login por PIN/biometria, chats privados, lembretes e predefinições de modelo.

OpenClawRadar
Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%
Tools

Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%

Um desenvolvedor relata que trocar o runtime de um sistema multiagente para Qwen 3.6 35B A3B (MoE, 3B parâmetros ativos) eliminou falhas de código, alcançando 100% de sucesso através de um portão de validação de 5 camadas.

OpenClawRadar
Gerenciador de Projetos Local no Estilo Trello para Agentes OpenClaw
Tools

Gerenciador de Projetos Local no Estilo Trello para Agentes OpenClaw

Um desenvolvedor construiu uma ferramenta local de gerenciamento de projetos semelhante ao Trello que roda na mesma máquina que seu agente OpenClaw, armazenando cartões como arquivos markdown com frontmatter YAML. O sistema usa Node.js/Express para a API, React para a interface e permite que o agente de IA leia/escreva arquivos diretamente no sistema de arquivos.

OpenClawRadar
Argus: Um Aplicativo do GitHub que Revisa Arquivos CLAUDE.md e Publica Pontuações em PRs
Tools

Argus: Um Aplicativo do GitHub que Revisa Arquivos CLAUDE.md e Publica Pontuações em PRs

Argus é um aplicativo do GitHub construído com Claude Code que revisa arquivos CLAUDE.md e posta uma pontuação em cada pull request. Após testes em múltiplos repositórios, as falhas mais comuns são a falta de limites de escopo explícitos e caminhos de escalonamento.

OpenClawRadar