ProofShot: CLI für KI-Agenten zur Überprüfung von UI-Code mit Browser-Aufzeichnung

Was ProofShot macht
ProofShot ist ein CLI-Tool, das KI-Codierungsagenten visuelle Verifizierungsfähigkeiten bietet. Es ermöglicht Agenten zu sehen, wie die von ihnen erstellte Benutzeroberfläche tatsächlich im Browser aussieht, Layoutprobleme zu erkennen und Konsolenfehler zu erfassen.
Wie es funktioniert
Das Tool arbeitet mit drei Hauptbefehlen:
proofshot start --run "npm run dev" --port 3000- Startet Ihren Entwicklungsserver, öffnet headless Chromium und beginnt mit der Videoaufzeichnung- Ihr KI-Agent führt dann Aktionen wie
proofshot exec navigate "http://localhost:3000"undproofshot exec screenshot "homepage"aus, um zu navigieren, zu klicken, Formulare auszufüllen und Screenshots zu erstellen proofshot stop- Sammelt Fehler, stoppt die Aufzeichnung, schneidet Leerlaufzeiten heraus und erzeugt Beweisartefakte
Ausgabe und Funktionen
ProofShot erzeugt eine eigenständige HTML-Datei, die enthält:
- Video-Wiedergabe der Browsersitzung synchronisiert mit einer Aktionszeitleiste
- Während der Sitzung erstellte Screenshots
- Elementbeschriftungen für jede Aktion
- Während der Sitzung erfasste Browser-Konsolenfehler
- Serverscans mit Mustererkennung für JavaScript, Python, Go, Rust und andere Sprachen
- PR-fertige Artefakte einschließlich SUMMARY.md und formatierten Ausgaben für Pull Requests
- Visuellen Vergleich mit Baselines
Technische Details
Das Tool ist:
- Auf agent-browser von Vercel Labs aufgebaut (beschrieben als "weitaus besser und schneller als Playwright MCP")
- Kein Testframework - der Agent entscheidet nicht über Bestehen/Nichtbestehen, sondern liefert nur Beweise
- Agentenunabhängig - funktioniert mit Claude Code, Cursor, Codex, Gemini CLI, Windsurf und jedem MCP-kompatiblen Agenten
- Als Skill verpackt, damit KI-Agenten genau wissen, wie es funktioniert
- Open Source mit MIT-Lizenz
Installation und Einrichtung
$ npm install -g proofshot
$ proofshot install
Das Tool schneidet automatisch Leerlaufzeiten aus Aufzeichnungen heraus, sodass Sie nur sehen, was der Agent tatsächlich getan hat, nicht inaktive Wartezeiten.
📖 Read the full source: HN LLM Tools
👀 Siehe auch

Buch-Bibliothekar: Verfolge deine Lektüre, erhalte spoilerfreie Empfehlungen
Ein OpenClaw-Skill, der dein Leseverhalten erfasst, zuerst aus deinem Besitz empfiehlt und im Laufe der Zeit deinen Geschmackswandel lernt.

Claude DevTools: Ein Log-Reader für verbesserte Sichtbarkeit von Claude-Code
Claude DevTools ist ein lokales, Open-Source-Tool, das die bestehenden Protokolldateien von Claude Code in ~/.claude/ liest, um detaillierte Sichtbarkeit in Sitzungen zu bieten, einschließlich Dateioperationen mit Inline-Diffs, Token-Aufschlüsselungen, Visualisierung des Kontextfensters und vollständigen Ausführungsbäumen von Subagenten.
Mergetrain: Eine lokale Merge-Warteschlange für parallele Claude-Code-Sitzungen, die überschriebene Pushes verhindert
Mergetrain ist eine lokale Merge-Warteschlange, die verhindert, dass parallele Claude Code-Sitzungen gegenseitig ihre Pushs überschreiben. Sie verwendet Worktrees, einen Pre-Push-Hook und einen einzelnen Runner, der Branches zu einem Zug zusammenstellt, Tests ausführt und dann atomar pusht.

Specsmaxxing: KI-Psychose mit YAML-Spezifikationen und ACAI bekämpfen
Acai.sh stellt Specsmaxxing vor: eine Methode, um dem Kontextverlust von KI-Agenten entgegenzuwirken, indem Anforderungen in YAML geschrieben und nummerierte Akzeptanzkriterien für KI (ACAI) verwendet werden, auf die Agenten im Code verweisen.