ProofShot: CLI para Agentes de IA para Verificar Código de Interfaz de Usuario con Grabación del Navegador

Qué hace ProofShot
ProofShot es una herramienta CLI que brinda a los agentes de codificación con IA capacidades de verificación visual. Permite a los agentes ver cómo se ve realmente la interfaz de usuario que construyen en el navegador, detectar problemas de diseño y capturar errores de la consola.
Cómo funciona
La herramienta opera mediante tres comandos principales:
proofshot start --run "npm run dev" --port 3000- Inicia tu servidor de desarrollo, abre Chromium sin interfaz y comienza a grabar video- Tu agente de IA luego ejecuta acciones como
proofshot exec navigate "http://localhost:3000"yproofshot exec screenshot "homepage"para navegar, hacer clic, llenar formularios y tomar capturas de pantalla proofshot stop- Recopila errores, detiene la grabación, recorta tiempo muerto y genera artefactos de prueba
Salida y características
ProofShot genera un archivo HTML independiente que contiene:
- Reproducción de video de la sesión del navegador sincronizada con una línea de tiempo de acciones
- Capturas de pantalla tomadas durante la sesión
- Etiquetas de elementos para cada acción
- Errores de la consola del navegador capturados durante la sesión
- Registros del servidor escaneados con coincidencia de patrones para JavaScript, Python, Go, Rust y otros lenguajes
- Artefactos listos para PR que incluyen SUMMARY.md y salida formateada para solicitudes de extracción
- Comparación visual de diferencias contra líneas base
Detalles técnicos
La herramienta es:
- Construida sobre agent-browser de Vercel Labs (descrito como "mucho mejor y más rápido que Playwright MCP")
- No es un marco de pruebas: el agente no decide aprobar/rechazar, solo proporciona evidencia
- Agnóstica al agente: funciona con Claude Code, Cursor, Codex, Gemini CLI, Windsurf y cualquier agente compatible con MCP
- Empaquetada como una habilidad para que los agentes de IA sepan exactamente cómo funciona
- De código abierto con licencia MIT
Instalación y configuración
$ npm install -g proofshot
$ proofshot install
La herramienta recorta automáticamente el tiempo muerto de las grabaciones, por lo que solo ves lo que el agente realmente hizo, no períodos de espera inactivos.
📖 Leer la fuente completa: HN LLM Tools
👀 Ver también

Configuración de iTerm2 de 4 Paneles para CLI de Código Claude Separa Roles de IA
Un desarrollador creó una configuración de terminal iTerm2 de cuatro paneles específicamente para Claude Code CLI para abordar la deriva de contexto y el sesgo de autoevaluación. Cada panel está bloqueado a un rol específico con modelos y permisos dedicados.

Auto Router vs Sonnet: Ahorro de Costos vs Calidad de Respuesta
La función Auto Router de Open Router selecciona dinámicamente modelos de lenguaje según la complejidad del contexto, ofreciendo ahorros significativos de costos (0.8 centavos vs 0.00071 centavos por solicitud), pero los usuarios reportan una calidad de respuesta degradada en comparación con Sonnet 4.6.

Desplegar Artefactos de Diseño de Claude en Sitios Web en Vivo con Teenyapp
Teenyapp proporciona un servicio de alojamiento que Claude Design puede usar directamente desde el chat mediante un enlace con token de agente, permitiendo el despliegue autónomo de artefactos con soporte de backend.
MTP + Memoria Unificada Aumenta la Inferencia de llama.cpp un 30% en RTX 5090
Activar la especulación MTP junto con GGML_CUDA_ENABLE_UNIFIED_MEMORY=1 aumenta Qwen3.6-27B Q8_0 de 49 a 64 tok/seg en una RTX 5090 con 128 GB de RAM del sistema.