TREX: O Revisor de Código com IA da Greptile que Executa Seu Código

A Greptile lançou o TREX (Test, Run, Execute), uma camada de execução que roda seu código durante a revisão de código com IA. Em vez de apenas ler diffs, o TREX realmente executa o código alterado e revela bugs de runtime — regressões de UI, erros de lógica dependentes de estado, condições de corrida — que a análise estática não consegue capturar.
Arquitetura: Orquestrador + Subagentes por Problema
Versões iniciais tentaram agentes separados ou um único agente combinado. Ambos falharam: agentes separados duplicavam trabalho sem contexto compartilhado; um único agente ficava sobrecarregado gerenciando setup, screenshots e testes. A solução foi um agente orquestrador (o revisor principal do Greptile) que lê o diff, identifica problemas suspeitos e cria um subagente TREX dedicado por problema, todos rodando em paralelo. Cada subagente herda o contexto do orquestrador e tem sua própria janela de contexto focada na investigação específica.
Exemplo: uma funcionalidade de UI atrás de um gate de autenticação. Um subagente configura o ambiente autonomamente, lida com autenticação, alterna feature flags e retorna um screenshot da funcionalidade renderizada.
Artefatos Multimodais vs. Tópicos
O output inicial do TREX era resumos em tópicos — mas tópicos permitiam alucinações (por exemplo, afirmar que um teste passou quando não passou) e não davam meio de verificar. A correção: cada descoberta do TREX é apoiada por um conjunto de artefatos multimodais: screenshots, logs de execução, traces de API e scripts de execução. Cada modalidade conta parte da história, tornando possível rastrear exatamente o que aconteceu. O primeiro artefato que impressionou a equipe foi um vídeo capturando uma mudança de animação — mostrando o efeito real em runtime.
O Que Ele Detecta
O TREX tem como alvo bugs que não aparecem em diffs de código: erros de lógica que exigem sequências específicas de estado, regressões de UI após o carregamento da página, e condições de corrida que precisam de requisições reais. Ele gera e executa testes, mas o foco é encontrar bugs, não apenas escrever testes. O subagente descobre o setup por conta própria.
Como Shlok Mehrotra, o engenheiro por trás do TREX, diz: "Você pode ler o diff perfeitamente e ainda assim perder completamente esses tipos de bugs."
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Hearth: Aplicativo de Chat AI Multiusuário Autohospedado para Residências no OpenClaw
Hearth é um aplicativo de chat de IA doméstico auto-hospedado construído sobre o OpenClaw que fornece contas e conversas separadas para cada membro da família, com recursos incluindo login por PIN/biometria, chats privados, lembretes e predefinições de modelo.

Modelo MoE Local 35B reduz taxa de falha de código do Agent OS para 0%
Um desenvolvedor relata que trocar o runtime de um sistema multiagente para Qwen 3.6 35B A3B (MoE, 3B parâmetros ativos) eliminou falhas de código, alcançando 100% de sucesso através de um portão de validação de 5 camadas.

Gerenciador de Projetos Local no Estilo Trello para Agentes OpenClaw
Um desenvolvedor construiu uma ferramenta local de gerenciamento de projetos semelhante ao Trello que roda na mesma máquina que seu agente OpenClaw, armazenando cartões como arquivos markdown com frontmatter YAML. O sistema usa Node.js/Express para a API, React para a interface e permite que o agente de IA leia/escreva arquivos diretamente no sistema de arquivos.

Argus: Um Aplicativo do GitHub que Revisa Arquivos CLAUDE.md e Publica Pontuações em PRs
Argus é um aplicativo do GitHub construído com Claude Code que revisa arquivos CLAUDE.md e posta uma pontuação em cada pull request. Após testes em múltiplos repositórios, as falhas mais comuns são a falta de limites de escopo explícitos e caminhos de escalonamento.