ProofShot: CLI für KI-Agenten zur Überprüfung von UI-Code mit Browser-Aufzeichnung

Was ProofShot macht
ProofShot ist ein CLI-Tool, das KI-Codierungsagenten visuelle Verifizierungsfähigkeiten bietet. Es ermöglicht Agenten zu sehen, wie die von ihnen erstellte Benutzeroberfläche tatsächlich im Browser aussieht, Layoutprobleme zu erkennen und Konsolenfehler zu erfassen.
Wie es funktioniert
Das Tool arbeitet mit drei Hauptbefehlen:
proofshot start --run "npm run dev" --port 3000- Startet Ihren Entwicklungsserver, öffnet headless Chromium und beginnt mit der Videoaufzeichnung- Ihr KI-Agent führt dann Aktionen wie
proofshot exec navigate "http://localhost:3000"undproofshot exec screenshot "homepage"aus, um zu navigieren, zu klicken, Formulare auszufüllen und Screenshots zu erstellen proofshot stop- Sammelt Fehler, stoppt die Aufzeichnung, schneidet Leerlaufzeiten heraus und erzeugt Beweisartefakte
Ausgabe und Funktionen
ProofShot erzeugt eine eigenständige HTML-Datei, die enthält:
- Video-Wiedergabe der Browsersitzung synchronisiert mit einer Aktionszeitleiste
- Während der Sitzung erstellte Screenshots
- Elementbeschriftungen für jede Aktion
- Während der Sitzung erfasste Browser-Konsolenfehler
- Serverscans mit Mustererkennung für JavaScript, Python, Go, Rust und andere Sprachen
- PR-fertige Artefakte einschließlich SUMMARY.md und formatierten Ausgaben für Pull Requests
- Visuellen Vergleich mit Baselines
Technische Details
Das Tool ist:
- Auf agent-browser von Vercel Labs aufgebaut (beschrieben als "weitaus besser und schneller als Playwright MCP")
- Kein Testframework - der Agent entscheidet nicht über Bestehen/Nichtbestehen, sondern liefert nur Beweise
- Agentenunabhängig - funktioniert mit Claude Code, Cursor, Codex, Gemini CLI, Windsurf und jedem MCP-kompatiblen Agenten
- Als Skill verpackt, damit KI-Agenten genau wissen, wie es funktioniert
- Open Source mit MIT-Lizenz
Installation und Einrichtung
$ npm install -g proofshot
$ proofshot install
Das Tool schneidet automatisch Leerlaufzeiten aus Aufzeichnungen heraus, sodass Sie nur sehen, was der Agent tatsächlich getan hat, nicht inaktive Wartezeiten.
📖 Read the full source: HN LLM Tools
👀 Siehe auch

Entwickler baut Rust-Kompressionsbibliothek mit Claude Opus 4.6, stellt Nützlichkeit infrage
Ein Entwickler nutzte Claude Opus 4.6 zwei Wochen lang, um eine Rust-Kompressionsbibliothek mit 15.800 Zeilen Code, 449 bestandenen Tests, Python-Bindings und einer C-FFI-Schicht zu erstellen, stellt jedoch in Frage, ob eine weitere Kompressionsbibliothek überhaupt nötig war.

MCP als Beobachtbarkeitsschnittstelle: Verbindung von KI-Agenten mit Kernel-Tracepoints
Das Model Context Protocol (MCP) entwickelt sich zur Schnittstelle zwischen KI-Agenten und Infrastruktur-Telemetrie, wobei Datadog einen MCP-Server ausliefert und Qualys Sicherheitsbedenken äußert. Der Artikel untersucht zwei Ansätze: das Einbinden bestehender Plattformen oder den Aufbau von MCP-nativer Observability, die direkt mit Kernel-Tracepoints verbindet.

Pilot Shell: Eine strukturierte Workflow-Schicht für Claude Code
Pilot Shell fügt spezifikationsgesteuerte TDD-Workflows, Qualitäts-Hooks, Context Engineering und Token-Optimierung auf Basis von Claude Code hinzu – ohne die Komplexität von Multi-Agenten-Frameworks.

Storybloq: Ein Projekt-Tracker im .story/-Verzeichnis Ihres Repos hat jetzt eine Mac-App
Storybloq, ein Projekt-Tracker, der Tickets, Issues, Roadmap-Phasen und Sitzungsübergaben als JSON/Markdown in einem .story/-Verzeichnis in Ihrem Repository speichert, ist jetzt als kostenlose Mac-App im App Store erhältlich. Es integriert sich über CLI und MCP-Server mit Claude Code und wurde vollständig mit Claude Code erstellt.