Агент-Xray: Инструмент с открытым исходным кодом для отладки сбоев ИИ-агентов на основе журналов трассировки

Agent-Xray — это инструмент с открытым кодом для отладки ИИ-агентов путём анализа их журналов трассировки. Он был создан для решения проблемы, когда агенты не справляются с задачами без явных ошибок — ситуаций, в которых код выполняется корректно, но агент принимает неверные решения, например, многократно вызывает неправильный инструмент, несмотря на сообщения об ошибках, указывающие на правильный.
Ключевые возможности
Инструмент читает журналы трассировки и предоставляет структурную оценку и классификацию первопричин сбоев агентов. Он воссоздаёт, что видел агент на каждом шаге, чтобы помочь понять, почему были приняты ошибочные решения.
Категории сбоев
- spin
- tool_bug
- early_abort
Режим enforcement
По словам создателя, наиболее значимой функцией является режим enforcement. После исправления ошибки агента этот режим запускает сложные задачи для проверки ваших исправлений на устойчивость. Он проверяет:
- Жёстко заданные возвращаемые значения
- Ослабленные утверждения
Это решает проблему, когда исправления могут работать на конкретных тестовых задачах, но на самом деле являются хрупкими, или когда агенты учатся обходить тесты.
Интеграция в рабочий процесс
Инструмент работает как инструменты MCP, позволяя Claude Code использовать его напрямую. Типичный рабочий процесс, описанный в источнике:
- Попросите Claude Code проанализировать трассировки агентов
- Он находит самый серьёзный сбой
- Воспроизводит, что видел агент
- Предлагает исправление
- Режим enforcement проверяет, что исправление действительно работает
Создатель описывает это как «агенты отлаживают агентов».
Технические детали
- Установка:
pip install agent-xray - Быстрый старт:
agent-xray quickstart(включает примеры трассировок для тестирования без ваших данных) - Лицензия: MIT
- Нет зависимостей
- Работает офлайн
- Совместим с трассировками OpenAI, Anthropic, LangChain, CrewAI, OpenTelemetry
- Возраст проекта: около 9 дней на момент публикации
Сценарий использования
Этот инструмент предназначен для разработчиков, работающих с ИИ-агентами, которым необходимо отлаживать сбои, не приводящие к традиционным ошибкам или трассировкам стека — ситуации, когда агенты принимают неверные решения, несмотря на доступ к правильным инструментам и информации.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также
Агентальманах: Каталог 23 MCP-серверов с готовыми к вставке JSON-конфигами
Пользователь Reddit составил каталог из 23 MCP-серверов с готовыми к вставке конфигами для Claude Desktop, Cursor и Continue. Обходит заархивированные серверы, указывая на поддерживаемые альтернативы. Демо-версия работает на Cloudflare Workers.

Неофициальный сервер MCP для кольца Ultrahuman для интеграции с AI-агентами
Сообщество разработало MCP-сервер, оборачивающий API Ultrahuman Partner, позволяя AI-агентам для программирования напрямую получать доступ к данным с кольца и CGM-устройств, таким как сон, ВСР, глюкоза и показатели восстановления, через структурированные вызовы данных.
PullMD v2.4.1:新增针对claude.ai网页的原生MCP连接器及多用户认证
PullMD v2.4.1 теперь поддерживает диалог пользовательского коннектора claude.ai через OAuth 2.1 + PKCE-S256 и добавляет многопользовательские режимы аутентификации. Превращайте любой URL в чистый Markdown с помощью самоуправляемого MCP.

Обнаружение скрытых сбоев инструментов в AI-кодирующих агентах с помощью Vibeyard
Vibeyard — это инструмент, который обнаруживает, когда AI-агенты для написания кода сталкиваются с тихими сбоями инструментов — ситуации, когда агенты переходят к альтернативным стратегиям, не уведомляя разработчиков, — и выявляет эти неэффективности во время сессий. Он может предлагать исправления, чтобы предотвратить повторение неэффективных рабочих процессов.