Агент-Xray: Инструмент с открытым исходным кодом для отладки сбоев ИИ-агентов на основе журналов трассировки

Agent-Xray — это инструмент с открытым кодом для отладки ИИ-агентов путём анализа их журналов трассировки. Он был создан для решения проблемы, когда агенты не справляются с задачами без явных ошибок — ситуаций, в которых код выполняется корректно, но агент принимает неверные решения, например, многократно вызывает неправильный инструмент, несмотря на сообщения об ошибках, указывающие на правильный.
Ключевые возможности
Инструмент читает журналы трассировки и предоставляет структурную оценку и классификацию первопричин сбоев агентов. Он воссоздаёт, что видел агент на каждом шаге, чтобы помочь понять, почему были приняты ошибочные решения.
Категории сбоев
- spin
- tool_bug
- early_abort
Режим enforcement
По словам создателя, наиболее значимой функцией является режим enforcement. После исправления ошибки агента этот режим запускает сложные задачи для проверки ваших исправлений на устойчивость. Он проверяет:
- Жёстко заданные возвращаемые значения
- Ослабленные утверждения
Это решает проблему, когда исправления могут работать на конкретных тестовых задачах, но на самом деле являются хрупкими, или когда агенты учатся обходить тесты.
Интеграция в рабочий процесс
Инструмент работает как инструменты MCP, позволяя Claude Code использовать его напрямую. Типичный рабочий процесс, описанный в источнике:
- Попросите Claude Code проанализировать трассировки агентов
- Он находит самый серьёзный сбой
- Воспроизводит, что видел агент
- Предлагает исправление
- Режим enforcement проверяет, что исправление действительно работает
Создатель описывает это как «агенты отлаживают агентов».
Технические детали
- Установка:
pip install agent-xray - Быстрый старт:
agent-xray quickstart(включает примеры трассировок для тестирования без ваших данных) - Лицензия: MIT
- Нет зависимостей
- Работает офлайн
- Совместим с трассировками OpenAI, Anthropic, LangChain, CrewAI, OpenTelemetry
- Возраст проекта: около 9 дней на момент публикации
Сценарий использования
Этот инструмент предназначен для разработчиков, работающих с ИИ-агентами, которым необходимо отлаживать сбои, не приводящие к традиционным ошибкам или трассировкам стека — ситуации, когда агенты принимают неверные решения, несмотря на доступ к правильным инструментам и информации.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

OnUI: Расширение для браузера для точной обратной связи по интерфейсу в Claude Code
OnUI — это расширение для браузера, которое позволяет аннотировать элементы веб-страниц и экспортировать структурированные отчёты для Claude Code через локальный MCP, устраняя неоднозначные описания интерфейса. Разработанное в основном с помощью Claude Code, оно бесплатно, имеет открытый исходный код и доступно для Chrome, Edge и Firefox.

Клод как компилятор: Практический пересмотр подхода к разработке ИИ
В посте на Reddit утверждается, что Claude Code функционирует как компилятор, переводящий английский язык в работающее программное обеспечение, проводя параллели с историческими прорывами в вычислительной технике, такими как A-0 Грейс Хоппер и FORTRAN. Автор описывает генерацию 400 строк кода в 6 файлах из трёх абзацев описания на английском, обнаружив две проблемы за 25 минут.

Клодигочи: Физическое устройство Тамагочи, которое питается активностью кода Клода
Клодиготчи — это физическое настольное существо, работающее на ESP32 с ЖК-экраном, которое подключается к Claude Code через плагин. Система голода устройства реагирует на активность кодирования, с визуальными состояниями и звуковыми эффектами, которые усиливаются, когда Claude оставляют бездействующим.

PageAgent: Браузерный ИИ-агент, работающий внутри веб-страниц с поддержкой Ollama
PageAgent — это JavaScript-библиотека, которая запускает ИИ-агентов прямо на веб-страницах, считывая DOM в реальном времени как текст, вместо использования скриншотов. Она работает с любой OpenAI-совместимой конечной точкой, включая Ollama, что позволяет выполнять локальные вызовы LLM прямо из браузера.