Arnês do Navegador: Concedendo aos LLMs acesso bruto ao CDP para autocorrigir tarefas no navegador

✍️ OpenClawRadar📅 Publicado: April 24, 2026🔗 Source
Arnês do Navegador: Concedendo aos LLMs acesso bruto ao CDP para autocorrigir tarefas no navegador
Ad

Browser Harness é um harness auto-recuperável que dá às LLMs liberdade total para concluir tarefas no navegador ao se conectar diretamente ao Chrome via um websocket CDP (~592 linhas de Python). Em vez de envolver o Chrome em funções predefinidas (como Playwright MCP ou agent-browser), ele fornece um daemon leve que mantém o websocket, ajudantes básicos e um arquivo SKILL.md — e deixa o agente escrever suas próprias ferramentas quando necessário.

Como funciona

Os conceitos principais são:

  • Um daemon que mantém o websocket CDP ativo
  • Ferramentas extremamente básicas em helpers.py (~195 linhas)
  • Um SKILL.md que explica o uso

Quando a LLM precisa de uma função que não existe, ela edita helpers.py e a adiciona. Os autores relatam um caso em que o agente queria fazer upload de um arquivo, não encontrou uma função upload_file(), escreveu ela mesma usando DOM.setFileInputFiles e continuou — visível apenas em um git diff.

Ad

vs. outras abordagens

Outras ferramentas (Playwright MCP, browser-use CLI, agent-browser, Chrome DevTools MCP) envolvem o Chrome em funções predefinidas. Seu pior modo de falha é silencioso: click() retorna sucesso, mas nada aconteceu. Browser Harness visa dar à LLM contexto perfeito e liberdade para autocorreção.

Configuração e instalação

Instale com Claude Code ou Codex colando:

Set up https://github.com/browser-use/browser-harness for me.

O agente lê install.md para inicialização, depois SKILL.md para uso normal e sempre verifica helpers.py para funções disponíveis.

Exemplos reais

  • Joga o motor de xadrez Stockfish
  • Define um recorde mundial no Tetris
  • Desenha um coração com JavaScript

Contribuindo

Contribuições bem-vindas: adicione habilidades de domínio em domain-skills/ para sites como LinkedIn, Amazon, etc. As habilidades são geradas pelo harness, não escritas à mão. Correções de bugs, documentação e melhorias nos helpers também são aceitas.

Licença: MIT.

📖 Leia a fonte completa: HN LLM Tools

Ad

👀 See Also

Ferramenta de Navegador de Código Aberto para Testar Servidores MCP Sem Instalação
Tools

Ferramenta de Navegador de Código Aberto para Testar Servidores MCP Sem Instalação

Uma ferramenta web de código aberto chamada MCP Playground permite que desenvolvedores testem servidores MCP diretamente em seus navegadores usando WebContainers, um runtime Node.js baseado em WASM. Ela pode executar servidores MCP baseados em npm localmente sem instalação de backend e conectar-se a servidores remotos via URL.

OpenClawRadar
A habilidade Claude Code gera capturas de tela da App Store usando a IA Gemini
Tools

A habilidade Claude Code gera capturas de tela da App Store usando a IA Gemini

Uma nova habilidade do Claude Code chamada /aso-cosmicmeta-ss cria capturas de tela da App Store e do Google Play por meio de um fluxo de trabalho de 6 fases que analisa bases de código e usa a IA Gemini para aprimoramento. A habilidade inclui um portão de aprovação para detectar problemas de layout antes de usar créditos da API.

OpenClawRadar
Vellium adiciona animais de estimação de desktop e agentes inspirados em CLI para LLMs locais
Tools

Vellium adiciona animais de estimação de desktop e agentes inspirados em CLI para LLMs locais

Vellium, um aplicativo multiplataforma de código aberto para LLMs locais, agora oferece suporte a animais de estimação virtuais que flutuam sobre janelas e agentes com integração MCP, comandos de terminal e edição de arquivos.

OpenClawRadar
🦀
Tools

Imposto de Habilidades do Claude Code: 2.596 Habilidades Instaladas, 40 Usadas, $91/Mês Desperdiçados

Cada habilidade do Claude Code instalada carrega no prompt do sistema de cada sessão. Um usuário mediu 102.651 tokens carregados por sessão, com 98,6% nunca usados, custando ~$91/mês. Uma ferramenta de código aberto, skill-tax, audita uso e custo.

OpenClawRadar