Агент-Xray: Инструмент с открытым исходным кодом для отладки сбоев ИИ-агентов на основе журналов трассировки

✍️ OpenClawRadar📅 Опубликовано: 15 апреля 2026 г.🔗 Source
Агент-Xray: Инструмент с открытым исходным кодом для отладки сбоев ИИ-агентов на основе журналов трассировки
Ad

Agent-Xray — это инструмент с открытым кодом для отладки ИИ-агентов путём анализа их журналов трассировки. Он был создан для решения проблемы, когда агенты не справляются с задачами без явных ошибок — ситуаций, в которых код выполняется корректно, но агент принимает неверные решения, например, многократно вызывает неправильный инструмент, несмотря на сообщения об ошибках, указывающие на правильный.

Ключевые возможности

Инструмент читает журналы трассировки и предоставляет структурную оценку и классификацию первопричин сбоев агентов. Он воссоздаёт, что видел агент на каждом шаге, чтобы помочь понять, почему были приняты ошибочные решения.

Категории сбоев

  • spin
  • tool_bug
  • early_abort

Режим enforcement

По словам создателя, наиболее значимой функцией является режим enforcement. После исправления ошибки агента этот режим запускает сложные задачи для проверки ваших исправлений на устойчивость. Он проверяет:

  • Жёстко заданные возвращаемые значения
  • Ослабленные утверждения

Это решает проблему, когда исправления могут работать на конкретных тестовых задачах, но на самом деле являются хрупкими, или когда агенты учатся обходить тесты.

Ad

Интеграция в рабочий процесс

Инструмент работает как инструменты MCP, позволяя Claude Code использовать его напрямую. Типичный рабочий процесс, описанный в источнике:

  1. Попросите Claude Code проанализировать трассировки агентов
  2. Он находит самый серьёзный сбой
  3. Воспроизводит, что видел агент
  4. Предлагает исправление
  5. Режим enforcement проверяет, что исправление действительно работает

Создатель описывает это как «агенты отлаживают агентов».

Технические детали

  • Установка: pip install agent-xray
  • Быстрый старт: agent-xray quickstart (включает примеры трассировок для тестирования без ваших данных)
  • Лицензия: MIT
  • Нет зависимостей
  • Работает офлайн
  • Совместим с трассировками OpenAI, Anthropic, LangChain, CrewAI, OpenTelemetry
  • Возраст проекта: около 9 дней на момент публикации

Сценарий использования

Этот инструмент предназначен для разработчиков, работающих с ИИ-агентами, которым необходимо отлаживать сбои, не приводящие к традиционным ошибкам или трассировкам стека — ситуации, когда агенты принимают неверные решения, несмотря на доступ к правильным инструментам и информации.

📖 Read the full source: r/ClaudeAI

Ad

👀 Смотрите также

🦀
Инструменты

Агентальманах: Каталог 23 MCP-серверов с готовыми к вставке JSON-конфигами

Пользователь Reddit составил каталог из 23 MCP-серверов с готовыми к вставке конфигами для Claude Desktop, Cursor и Continue. Обходит заархивированные серверы, указывая на поддерживаемые альтернативы. Демо-версия работает на Cloudflare Workers.

OpenClawRadar
Неофициальный сервер MCP для кольца Ultrahuman для интеграции с AI-агентами
Инструменты

Неофициальный сервер MCP для кольца Ultrahuman для интеграции с AI-агентами

Сообщество разработало MCP-сервер, оборачивающий API Ultrahuman Partner, позволяя AI-агентам для программирования напрямую получать доступ к данным с кольца и CGM-устройств, таким как сон, ВСР, глюкоза и показатели восстановления, через структурированные вызовы данных.

OpenClawRadar
🦀
Инструменты

PullMD v2.4.1:新增针对claude.ai网页的原生MCP连接器及多用户认证

PullMD v2.4.1 теперь поддерживает диалог пользовательского коннектора claude.ai через OAuth 2.1 + PKCE-S256 и добавляет многопользовательские режимы аутентификации. Превращайте любой URL в чистый Markdown с помощью самоуправляемого MCP.

OpenClawRadar
Обнаружение скрытых сбоев инструментов в AI-кодирующих агентах с помощью Vibeyard
Инструменты

Обнаружение скрытых сбоев инструментов в AI-кодирующих агентах с помощью Vibeyard

Vibeyard — это инструмент, который обнаруживает, когда AI-агенты для написания кода сталкиваются с тихими сбоями инструментов — ситуации, когда агенты переходят к альтернативным стратегиям, не уведомляя разработчиков, — и выявляет эти неэффективности во время сессий. Он может предлагать исправления, чтобы предотвратить повторение неэффективных рабочих процессов.

OpenClawRadar