Harnais de navigation : Offrir aux LLM un accès brut au protocole CDP pour autocorriger les tâches de navigation.

Browser Harness est un harnais auto-cicatrisant qui offre aux LLM une liberté totale pour accomplir des tâches navigateur en se connectant directement à Chrome via un websocket CDP (~592 lignes de Python). Au lieu d'envelopper Chrome dans des fonctions prédéfinies (comme Playwright MCP ou agent-browser), il fournit un démon léger qui maintient le websocket, des aides de base, et un fichier SKILL.md — et laisse l'agent écrire ses propres outils lorsque nécessaire.
Comment ça marche
Les concepts clés sont :
- Un démon qui maintient le websocket CDP actif
- Des outils extrêmement basiques dans
helpers.py(~195 lignes) - Un
SKILL.mdqui explique l'utilisation
Lorsque le LLM a besoin d'une fonction qui n'existe pas, il modifie helpers.py et l'ajoute. Les auteurs rapportent un cas où l'agent voulait télécharger un fichier, n'a trouvé aucune fonction upload_file(), l'a écrite lui-même en utilisant DOM.setFileInputFiles, et a continué — visible uniquement dans un diff git.
vs. autres approches
D'autres outils (Playwright MCP, browser-use CLI, agent-browser, Chrome DevTools MCP) enveloppent Chrome dans des fonctions prédéfinies. Leur pire mode d'échec est silencieux : click() retourne un succès mais rien ne se passe. Browser Harness vise à donner au LLM un contexte parfait et la liberté de s'auto-corriger.
Configuration et installation
Installez avec Claude Code ou Codex en collant :
Set up https://github.com/browser-use/browser-harness for me.
L'agent lit install.md pour le démarrage, puis SKILL.md pour l'utilisation normale, et vérifie toujours helpers.py pour les fonctions disponibles.
Exemples réels
- Joue au moteur d'échecs Stockfish
- Établit un record du monde à Tetris
- Dessine un cœur avec JavaScript
Contribuer
Les contributions sont les bienvenues : ajoutez des compétences domaine sous domain-skills/ pour des sites comme LinkedIn, Amazon, etc. Les compétences sont générées par le harnais, non écrites à la main. Les corrections de bugs, la documentation et les améliorations des aides sont également acceptées.
Licence : MIT.
📖 Read the full source: HN LLM Tools
👀 See Also
Le mode Brainstorming de ClaudeAI s’accompagne d’un visuel pour les maquettes et l’approbation UI
Un utilisateur découvre une nouvelle fonctionnalité « Compagnon visuel » dans le mode brainstorming de ClaudeAI qui sert des maquettes sur un serveur web local, permettant des allers-retours de modifications UI avant de construire.

Rudel : Analytique open-source pour les sessions Claude Code
Rudel est un outil d'analyse open-source qui examine les sessions Claude Code, fournissant des insights à partir de 1 573 sessions réelles avec plus de 15 millions de tokens et plus de 270 000 interactions. Il révèle des tendances comme une utilisation des compétences à 4 %, des taux d'abandon à 26 % et des modèles de cascade d'erreurs.

Qwen3.6-27B en tant que couche de raisonnement locale : résultats de test multi-agent sur 2 semaines
Un développeur a remplacé Claude par Qwen3.6-27B local dans un orchestrateur multi-agent pendant 2 semaines sur 47 workflows. Résultats : raisonnement solide, 12% d'erreurs de format d'appels d'outils et limite de contexte de 12k tokens.

Package de compétences en développement d'extensions Chrome open source publié
Le développeur quangpl a condensé quatre ans d'expérience en développement d'extensions Chrome en huit compétences d'agent IA couvrant la structuration avec WXT, la génération de manifeste, l'audit de sécurité, les tests, la génération d'actifs, la publication et la migration de MV2 à MV3.