ProofShot: CLI para Agentes de IA Verificarem Código de UI com Gravação de Navegador

O que o ProofShot faz
ProofShot é uma ferramenta CLI que dá aos agentes de IA de programação capacidades de verificação visual. Permite que os agentes vejam como a interface que constroem realmente aparece no navegador, detectem problemas de layout e capturem erros do console.
Como funciona
A ferramenta opera através de três comandos principais:
proofshot start --run "npm run dev" --port 3000- Inicia seu servidor de desenvolvimento, abre o Chromium headless e começa a gravar vídeo- Seu agente de IA então executa ações como
proofshot exec navigate "http://localhost:3000"eproofshot exec screenshot "homepage"para navegar, clicar, preencher formulários e tirar capturas de tela proofshot stop- Coleta erros, para a gravação, remove tempos mortos e gera artefatos de prova
Saída e recursos
ProofShot gera um arquivo HTML autônomo contendo:
- Reprodução de vídeo da sessão do navegador sincronizada com uma linha do tempo de ações
- Capturas de tela tiradas durante a sessão
- Rótulos de elementos para cada ação
- Erros do console do navegador capturados durante a sessão
- Logs do servidor escaneados com correspondência de padrões para JavaScript, Python, Go, Rust e outras linguagens
- Artefatos prontos para PR incluindo SUMMARY.md e saída formatada para pull requests
- Comparação visual de diferenças contra baselines
Detalhes técnicos
A ferramenta é:
- Construída sobre agent-browser da Vercel Labs (descrito como "muito melhor e mais rápido que Playwright MCP")
- Não é uma estrutura de teste - o agente não decide aprovação/reprovação, apenas fornece evidências
- Agnóstica de agente - funciona com Claude Code, Cursor, Codex, Gemini CLI, Windsurf e qualquer agente compatível com MCP
- Empacotada como uma habilidade para que os agentes de IA saibam exatamente como funciona
- Código aberto com licença MIT
Instalação e configuração
$ npm install -g proofshot
$ proofshot install
A ferramenta remove automaticamente tempos mortos das gravações, então você vê apenas o que o agente realmente fez, não períodos de espera ociosa.
📖 Read the full source: HN LLM Tools
👀 See Also
Lovelace: Gerenciamento de Projetos para Claude Code que Vive no Seu Repositório
Um aplicativo de desktop onde tickets, documentos e registros de sessão são arquivos Markdown dentro do seu repositório. O aplicativo renderiza um quadro kanban a partir dos arquivos, e o Claude trabalha nos mesmos arquivos através de 8 ferramentas MCP. Gratuito, sem necessidade de conta.

Audacity-MCP: Integração Claude IA para Edição de Áudio Local com 131 Ferramentas
Audacity-MCP conecta Claude ao Audacity via interface de pipe, permitindo edição de áudio controlada por voz com 131 ferramentas, 9 pipelines automatizados e transcrição local com Whisper sem dependências de nuvem.

GLM-5.1 vs MiniMax M2.7: Comparação de desempenho para agentes de IA de codificação
O GLM-5.1 alcança pontuações de 77,8 no SWE-bench-Verified e 56,2 no Terminal Bench 2.0, as mais altas entre os modelos de código aberto, enquanto o MiniMax M2.7 oferece respostas rápidas com baixo TTFT e alta taxa de transferência, ideal para bots de CI e edições em lote.

SmallClaw V1.0.3 Adiciona Suporte a Webhooks, Automação n8n e Servidor MCP
A versão 1.0.3 do SmallClaw introduz endpoints de webhook para acionar serviços externos, fluxos de trabalho de automação local com n8n e conexões de servidor MCP para integração de ferramentas. A atualização mantém o foco da ferramenta em funcionar com pequenos LLMs locais.