Agent-Xray: Open-Source-Tool zum Debuggen von KI-Agent-Fehlern aus Trace-Logs

Agent-Xray ist ein Open-Source-Tool zum Debuggen von KI-Agenten durch die Analyse ihrer Trace-Protokolle. Es wurde entwickelt, um das Problem zu lösen, dass Agenten Aufgaben ohne klare Fehlermeldungen nicht erfüllen – Situationen, in denen der Code einwandfrei läuft, der Agent aber falsche Entscheidungen trifft, wie etwa das wiederholte Aufrufen des falschen Tools, obwohl Fehlermeldungen das richtige nahelegen.
Hauptfunktionen
Das Tool liest Trace-Protokolle und bietet strukturelle Bewertung und Ursachenklassifizierung für Agentenfehler. Es rekonstruiert, was der Agent in jedem Schritt gesehen hat, um zu verstehen, warum schlechte Entscheidungen getroffen wurden.
Fehlerkategorien
- Spin
- Tool-Bug
- Early-Abort
Enforcement-Modus
Die bedeutendste Funktion laut dem Ersteller ist der Enforcement-Modus. Nach der Behebung eines Agenten-Fehlers führt dieser Modus adversarische Herausforderungen gegen Ihre Korrekturen aus, um zu überprüfen, ob sie legitim sind. Er prüft auf:
- Hartkodierte Rückgaben
- Abgeschwächte Assertions
Dies behebt das Problem, dass Korrekturen bei bestimmten Testaufgaben funktionieren könnten, aber tatsächlich fragil sind, oder dass Agenten lernen, den Test zu umgehen.
Workflow-Integration
Das Tool läuft als MCP-Tools, sodass Claude Code es direkt nutzen kann. Ein typischer Workflow laut der Quelle:
- Claude Code anweisen, Agenten-Traces zu triagieren
- Es findet den schwerwiegendsten Fehler
- Spielt wieder, was der Agent gesehen hat
- Schlägt eine Korrektur vor
- Der Enforcement-Modus überprüft, ob die Korrektur legitim ist
Der Ersteller beschreibt dies als "Agenten, die Agenten debuggen".
Technische Details
- Installation:
pip install agent-xray - Schnellstart:
agent-xray quickstart(enthält Beispiel-Traces zum Testen ohne eigene Daten) - Lizenz: MIT
- Keine Abhängigkeiten
- Läuft offline
- Funktioniert mit OpenAI-, Anthropic-, LangChain-, CrewAI-, OpenTelemetry-Traces
- Projektalter: Etwa 9 Tage zum Zeitpunkt der Veröffentlichung
Anwendungsfall
Dieses Tool ist für Entwickler gedacht, die mit KI-Agenten arbeiten und Fehler debuggen müssen, die keine traditionellen Fehler oder Stack-Traces erzeugen – Situationen, in denen Agenten trotz Zugriff auf korrekte Tools und Informationen falsche Entscheidungen treffen.
📖 Read the full source: r/ClaudeAI
👀 Siehe auch

Mandala v0.3: Open-Source-Runtime für asynchrone Logistik-Telemetrie als OpenTelemetry-Spans zur Agentenargumentation
Mandala v0.3 bietet eine quelloffene Async-Runtime, die Telemetriedaten von Samsara, Descartes, Vizion und FMCSA über Webhooks aufnimmt, Ereignisse als OpenTelemetry-Spans ausgibt und Daten über MCP-Tools für LLM-Agenten bereitstellt.

Motiv MCP verleiht Claude Code die Fähigkeit, Videos anzusehen, um UI-Fehler zu reproduzieren
Motif ist ein MCP-Server, der es Claude Code ermöglicht, Bildschirmaufnahmen von UI-Fehlern zu analysieren. Mit Gemini 2.5 Flash werden die Aufnahmen Einzelbild für Einzelbild ausgewertet, um visuelle Beschreibungen, Ursachen und Code-Unterschiede zu liefern. Die Einrichtung erfordert einen Gemini-API-Schlüssel und zwei Zeilen in der mcp.json.

Memento v1.0: Persistenter Speicher-MCP-Server für Claude Code mit 17 Werkzeugen
Memento v1.0 ist ein persistenter Speicher-MCP-Server für Claude Code, der mit 17 Tools, Hybridsuche, Widerspruchserkennung und einem visuellen Speichergraphen ausgestattet ist. Er läuft lokal ohne Cloud-Abhängigkeiten und unterstützt mehrere IDEs, darunter Claude Code, Cursor, Windsurf und OpenCode.

Aufbau eines Coding-Agenten für 8K-Kontext: Planer/Ausführer-Aufteilung, Token-Budgetierung und parallele Ausführung
Eine detaillierte Aufschlüsselung zum Bau eines CLI-Coding-Agenten, der für 8k-Token-Limits ausgelegt ist und eine Planer/Ausführer-Architektur, striktes Token-Budgeting und parallele Aufgabenausführung nutzt.