Protocolo de Navegador para Agentes: Fork de código aberto do Chrome para agentes de IA atinge 90% no benchmark Mind2Web

✍️ OpenClawRadar📅 Publicado: March 11, 2026🔗 Source
Protocolo de Navegador para Agentes: Fork de código aberto do Chrome para agentes de IA atinge 90% no benchmark Mind2Web
Ad

Protocolo de Navegador de Agente: Um navegador construído para agentes de IA

O Protocolo de Navegador de Agente (ABP) é um fork de navegador de código aberto do Chrome projetado especificamente para agentes de IA. O projeto foi criado como um desafio para construir um navegador centrado em agentes e conquistar a pontuação mais alta no Online Mind2Web Benchmark.

Abordagem técnica principal

A principal percepção por trás do ABP é que os agentes de IA se destacam em chat baseado em turnos, mas têm dificuldades com a tomada de decisões em tempo contínuo. Para maximizar o desempenho de LLMs em tarefas de navegador, o ABP converte a navegação na web em chat multimodal por meio de:

  • Congelar o JavaScript e o tempo após cada ação, para que a página da web fique congelada enquanto o agente pensa
  • Capturar todos os eventos relevantes resultantes das ações, incluindo seletores de arquivos, downloads, solicitações de permissão e diálogos
  • Retornar esses eventos junto com uma captura de tela da página congelada, para que o agente possa raciocinar holisticamente sobre o estado do navegador com contexto completo

Desempenho e desenvolvimento

O ABP alcançou 90,53% no Online Mind2Web Benchmark, mantendo a pontuação mais alta por dois dias até que o GPT-5.4 o superasse com 92,8%. O desenvolvedor usou o Claude Opus-4.5 para trabalhar no projeto durante noites e finais de semana, concluindo-o em dois meses.

Ad

Aplicações práticas

De acordo com a fonte, o ABP se destaca em:

  • Preencher formulários
  • Compras online
  • Download de arquivos
  • Upload de arquivos
  • Pedir comida para viagem
  • Engenharia reversa de APIs não documentadas de um site

Começando

Para adicionar o ABP ao Claude Code:

claude mcp add browser -- npx -y agent-browser-protocol --mcp

Então você pode dar comandos ao Claude como:

Find me kung pao chicken near 415 Mission St, San Francisco on Doordash.

Recursos

Repositório GitHub: https://github.com/theredsix/agent-browser-protocol

Resultados do benchmark: https://github.com/theredsix/abp-online-mind2web-results

📖 Read the full source: r/ClaudeAI

Ad

👀 See Also

Tycono: Plataforma de Agentes de IA de Código Aberto com Organograma e Ciclos de Melhoria Autônoma
Tools

Tycono: Plataforma de Agentes de IA de Código Aberto com Organograma e Ciclos de Melhoria Autônoma

Tycono é um sistema de código aberto onde você define funções de agentes de IA em YAML (CTO, engenheiro, QA, etc.) e eles trabalham juntos seguindo um organograma com ciclos de melhoria autônoma. O sistema executou 17 rodadas durante a noite em uma tarefa de jogo de corrida de pixels, gerando 6.796 linhas de código em 43 commits.

OpenClawRadar
Insights do Mundo Real sobre o Uso do OpenClaw com LLMs: Desafios e Limitações
Tools

Insights do Mundo Real sobre o Uso do OpenClaw com LLMs: Desafios e Limitações

Um usuário do OpenClaw descreve problemas de integração com LLMs, citando respostas sem sentido de um bot do Discord.

OpenClawRadar
TUI Studio: Ferramenta de Design Visual de Interface de Terminal em Fase Alfa
Tools

TUI Studio: Ferramenta de Design Visual de Interface de Terminal em Fase Alfa

O TUI Studio é um editor visual semelhante ao Figma para projetar interfaces de usuário de terminal com componentes de arrastar e soltar, pré-visualização ANSI em tempo real e exportação planejada para seis frameworks, incluindo Ink, BubbleTea e Textual. Atualmente em versão alfa com exportações não funcionais, está disponível para macOS, Windows e Docker.

OpenClawRadar
Guarda de Raciocínio: Detecção de Loop em Nível de Proxy para Inferência Local de LLM
Tools

Guarda de Raciocínio: Detecção de Loop em Nível de Proxy para Inferência Local de LLM

Uma camada de proteção no proxy que detecta e recupera de loops de raciocínio de LLMs usando verificações determinísticas no stream — limites de tokens, repetição de n-gramas e impressão digital de frases — sem modificações no modelo.

OpenClawRadar