"Arnés de Navegador: Otorgando a los LLM acceso directo a CDP para autocorregir tareas del navegador"

✍️ OpenClawRadar📅 Publicado: 24 de abril de 2026🔗 Source
"Arnés de Navegador: Otorgando a los LLM acceso directo a CDP para autocorregir tareas del navegador"
Ad

Browser Harness es un arnés auto-curativo que da a los LLMs total libertad para completar tareas del navegador conectándose directamente a Chrome a través de un websocket CDP (~592 líneas de Python). En lugar de envolver Chrome en funciones predefinidas (como Playwright MCP o agent-browser), proporciona un daemon ligero que mantiene el websocket, ayudantes básicos y un archivo SKILL.md — y permite al agente escribir sus propias herramientas cuando sea necesario.

Cómo funciona

Los conceptos centrales son:

  • Un daemon que mantiene vivo el websocket CDP
  • Herramientas extremadamente básicas en helpers.py (~195 líneas)
  • Un SKILL.md que explica el uso

Cuando el LLM necesita una función que no existe, edita helpers.py y la añade. Los autores reportan un caso donde el agente quería subir un archivo, no encontró una función upload_file(), la escribió él mismo usando DOM.setFileInputFiles, y continuó — visible solo en un git diff.

Ad

vs. otros enfoques

Otras herramientas (Playwright MCP, browser-use CLI, agent-browser, Chrome DevTools MCP) envuelven Chrome en funciones predefinidas. Su peor modo de fallo es silencioso: click() devuelve éxito pero no pasó nada. Browser Harness busca dar al LLM contexto perfecto y libertad para auto-corregirse.

Configuración e instalación

Instala con Claude Code o Codex pegando:

Configura https://github.com/browser-use/browser-harness para mí.

El agente lee install.md para arrancar, luego SKILL.md para uso normal, y siempre revisa helpers.py para funciones disponibles.

Ejemplos reales

  • Juega al motor de ajedrez Stockfish
  • Establece un récord mundial en Tetris
  • Dibuja un corazón con JavaScript

Contribuir

Contribuciones bienvenidas: añade habilidades de dominio en domain-skills/ para sitios como LinkedIn, Amazon, etc. Las habilidades son generadas por el arnés, no escritas a mano. Correcciones de errores, documentación y mejoras de ayudantes también se aceptan.

Licencia: MIT.

📖 Leer la fuente completa: HN LLM Tools

Ad

👀 Ver también

Ruflo: Plataforma de Código Abierto para Ejecutar Múltiples Agentes de IA como un Equipo
Herramientas

Ruflo: Plataforma de Código Abierto para Ejecutar Múltiples Agentes de IA como un Equipo

Ruflo es una plataforma de código abierto que te permite ejecutar múltiples agentes de IA juntos para trabajar como un equipo en tareas complejas. Anteriormente conocido como Claude Flow, ayuda a coordinar flujos de trabajo donde las tareas deben dividirse en partes.

OpenClawRadar
free-claude-code añade soporte para GLM-5 a través de NVIDIA NIM y se expande a OpenRouter y Discord.
Herramientas

free-claude-code añade soporte para GLM-5 a través de NVIDIA NIM y se expande a OpenRouter y Discord.

free-claude-code ahora admite GLM-5 a través del nivel gratuito de NVIDIA NIM (40 solicitudes/min) y agrega integración con OpenRouter, soporte para bot de Discord y compatibilidad con el proveedor local LMStudio. La herramienta convierte las solicitudes de API de Anthropic de Claude Code para funcionar con backends de modelos alternativos.

OpenClawRadar
McPherson AI lanza dos nuevas habilidades operativas para QSR en ClawHub: diagnóstico de costos de alimentos y auditoría de fugas de mano de obra.
Herramientas

McPherson AI lanza dos nuevas habilidades operativas para QSR en ClawHub: diagnóstico de costos de alimentos y auditoría de fugas de mano de obra.

Se han publicado dos nuevas habilidades gratuitas en ClawHub: qsr-food-cost-diagnostic detecta problemas de COGS semanalmente con un diagnóstico de cuatro palancas, y qsr-labor-leak-auditor proporciona seguimiento laboral diario con alertas a mitad de semana para prevenir gastos excesivos.

OpenClawRadar
La Optimización de ANE Mediante Experimentos de IA Dirigidos por Teléfono Muestra los Beneficios de la Fusión de Núcleos
Herramientas

La Optimización de ANE Mediante Experimentos de IA Dirigidos por Teléfono Muestra los Beneficios de la Fusión de Núcleos

Un desarrollador ejecutó 55 experimentos sobre la optimización del Apple Neural Engine, dirigiendo el proceso desde su teléfono usando Claude para lluvia de ideas. Las mejoras clave incluyeron fusionar 3 núcleos ANE en 1 mega-núcleo, reduciendo la pérdida de validación de 3.75 a 2.49 y el tiempo por paso de 176ms a 96ms.

OpenClawRadar