ProofShot: CLI para Agentes de IA Verificarem Código de UI com Gravação de Navegador

O que o ProofShot faz
ProofShot é uma ferramenta CLI que dá aos agentes de IA de programação capacidades de verificação visual. Permite que os agentes vejam como a interface que constroem realmente aparece no navegador, detectem problemas de layout e capturem erros do console.
Como funciona
A ferramenta opera através de três comandos principais:
proofshot start --run "npm run dev" --port 3000- Inicia seu servidor de desenvolvimento, abre o Chromium headless e começa a gravar vídeo- Seu agente de IA então executa ações como
proofshot exec navigate "http://localhost:3000"eproofshot exec screenshot "homepage"para navegar, clicar, preencher formulários e tirar capturas de tela proofshot stop- Coleta erros, para a gravação, remove tempos mortos e gera artefatos de prova
Saída e recursos
ProofShot gera um arquivo HTML autônomo contendo:
- Reprodução de vídeo da sessão do navegador sincronizada com uma linha do tempo de ações
- Capturas de tela tiradas durante a sessão
- Rótulos de elementos para cada ação
- Erros do console do navegador capturados durante a sessão
- Logs do servidor escaneados com correspondência de padrões para JavaScript, Python, Go, Rust e outras linguagens
- Artefatos prontos para PR incluindo SUMMARY.md e saída formatada para pull requests
- Comparação visual de diferenças contra baselines
Detalhes técnicos
A ferramenta é:
- Construída sobre agent-browser da Vercel Labs (descrito como "muito melhor e mais rápido que Playwright MCP")
- Não é uma estrutura de teste - o agente não decide aprovação/reprovação, apenas fornece evidências
- Agnóstica de agente - funciona com Claude Code, Cursor, Codex, Gemini CLI, Windsurf e qualquer agente compatível com MCP
- Empacotada como uma habilidade para que os agentes de IA saibam exatamente como funciona
- Código aberto com licença MIT
Instalação e configuração
$ npm install -g proofshot
$ proofshot install
A ferramenta remove automaticamente tempos mortos das gravações, então você vê apenas o que o agente realmente fez, não períodos de espera ociosa.
📖 Read the full source: HN LLM Tools
👀 See Also

Zerro: Aponte para seu aplicativo ao vivo, fale e veja o Claude Code editá-lo instantaneamente
Zerro é um aplicativo para Mac que permite apontar o cursor para um aplicativo em execução, descrever uma alteração em voz alta e fazer o Claude Code editar os arquivos reais ao vivo. Ele captura movimento, identifica qual elemento você quer e cria um checkpoint antes de cada execução.

ai-codex: Pré-indexe sua base de código para economizar tokens do Claude
ai-codex é uma ferramenta que gera índices compactos em markdown do seu código, permitindo que o Claude Code pule a fase inicial de exploração que normalmente consome 30-50K tokens por conversa. Ele cria cinco arquivos que cobrem rotas, páginas, bibliotecas, esquemas e componentes.

harshal-mcp-proxy Agora no npm: Um Único Daemon Substitui 12 Configurações de Servidor MCP
harshal-mcp-proxy agora está disponível como um pacote npm de 54 kB. Instale globalmente, execute como um daemon e substitua 12 configurações separadas de servidor MCP por 6 ferramentas, economizando aproximadamente 2,7 GB de RAM e ~50 mil tokens por sessão.

Desenvolvedor cria plugin MCP para WordPress com 28 habilidades de leitura/escrita
Um desenvolvedor criou um plugin WordPress que registra 28 habilidades MCP através da API de Habilidades do WordPress, permitindo acesso total de leitura/escrita para agentes de IA de programação. O plugin gerencia conteúdo, auditoria de qualidade e recursos de segurança, convertendo automaticamente entre Markdown e blocos Gutenberg.