TREX: ИИ-ревьюер кода от Greptile, который запускает ваш код

Компания Greptile выпустила TREX (Test, Run, Execute) — исполнительный слой, который запускает ваш код во время AI-ревью. Вместо простого чтения diff'ов TREX фактически выполняет изменённый код и выявляет баги времени выполнения — регрессии UI, логические ошибки, зависящие от состояния, состояния гонки — которые не может поймать статический анализ.
Архитектура: Оркестратор + под-агенты для каждой проблемы
Ранние версии использовали отдельные агенты или один комбинированный. Оба варианта провалились: отдельные агенты дублировали работу без общего контекста; один агент перегружался управлением настройкой, скриншотами и тестами. Решением стал оркестратор (главный ревьюер Greptile), который читает diff, выявляет подозрительные проблемы и запускает выделенного под-агента TREX для каждой проблемы, работающих параллельно. Каждый под-агент наследует контекст оркестратора и имеет собственное окно контекста, ограниченное своим исследованием.
Пример: функция UI за шлюзом аутентификации. Под-агент автономно настраивает окружение, обрабатывает аутентификацию, переключает флаги функций и возвращает скриншот отображаемой функции.
Мультимодальные артефакты vs. маркированные списки
Изначальный вывод TREX был в виде тезисов — но тезисы допускали галлюцинации (например, утверждение, что тест пройден, хотя это не так) и не давали возможности проверить. Исправление: каждый результат TREX подкреплён набором мультимодальных артефактов: скриншоты, логи выполнения, трассы API и скрипты выполнения. Каждый модальность рассказывает часть истории, позволяя точно отследить, что произошло. Первым впечатляющим артефактом стала видеозапись изменения анимации — показывающая реальный эффект во время выполнения.
Что он ловит
TREX нацелен на баги, которые не видны в diff'ах кода: логические ошибки, требующие определённых последовательностей состояний, регрессии UI после загрузки страницы и состояния гонки, требующие реальных запросов. Он генерирует и запускает тесты, но фокус на поиске багов, а не просто на написании тестов. Под-агент сам разбирается с настройкой.
Как говорит Шлок Мехротра, инженер, стоящий за TREX: «Можно идеально прочитать diff и всё равно полностью пропустить такие баги».
📖 Читать полный источник: HN AI Agents
👀 Смотрите также

Экранбокс: Открытый код виртуальных рабочих столов для ИИ-агентов, полностью созданных голосом
Screenbox предоставляет изолированные Linux-рабочие столы в Docker для AI-агентов, решая конфликты при параллельном запуске нескольких агентов. Проект был полностью создан с помощью голосовых команд в Claude Code, и создатель не видел ни одной строки кода.

Clawion: Обертка OpenClaw с поддержкой Claude Max и интеграцией с GitHub
Clawion — это обёртка OpenClaw, которая поддерживает Claude Max без необходимости ввода API-ключа. Настройка включает выбор шаблона, подключение Telegram и развёртывание компаньона по коду с интеграцией GitHub для автоматического создания PR.

SkillOpt: Оптимизация файлов навыков Markdown как обучаемых параметров для AI-агентов
SkillOpt формализует ad-hoc процесс редактирования файлов навыков Markdown для AI-агентов кодирования, используя передовые модели для предложения ограниченных правок, проверяемых на валидационных наборах. Лучшие навыки сходятся за 1-4 принятых правки из множества предложений и переносятся между моделями, например, от Codex к Claude Code.

ModelFitAI: Развертывайте AI-агентов без настройки VPS, создано с помощью Claude Code
ModelFitAI — это платформа, которая позволяет разработчикам развертывать ИИ-агентов без необходимости управления VPS-инфраструктурой. Инструмент был создан единственным основателем, который хотел избежать трудоемких процессов настройки серверов.