Navigateur CLI : Un outil d'automatisation de navigation économe en tokens pour les agents d'IA de codage

✍️ OpenClawRadar📅 Publié: April 15, 2026🔗 Source
Navigateur CLI : Un outil d'automatisation de navigation économe en tokens pour les agents d'IA de codage
Ad

Ce que fait Browser CLI

Browser CLI est un outil d'automatisation de navigateur conçu pour réduire la surcharge de tokens dans les agents d'IA de codage. Le créateur a remarqué que la vérification du navigateur consommait environ 30 000 tokens par session à cause de la surcharge du protocole Playwright MCP, chaque appel browser_navigate + browser_snapshot coûtant environ 1 500 tokens dans l'encadrement du schéma JSON.

La solution est un démon Chromium sans tête persistant avec lequel vous interagissez via des commandes Bash. Il utilise la même technologie de capture ARIA de Playwright en arrière-plan, mais atteint environ 50-100 tokens par appel au lieu d'environ 1 500.

Commandes et utilisation

Les commandes disponibles incluent :

  • browser-cli goto https://example.com - Naviguer vers l'URL
  • browser-cli snapshot -i - Arbre ARIA avec références @e
  • browser-cli click @e3 - Cliquer par référence
  • browser-cli fill @e5 "hello" - Remplir un champ de saisie
  • browser-cli css @e3 font-size - Obtenir la valeur CSS calculée
  • browser-cli inspect @e3 - Modèle de boîte complet + styles
  • browser-cli screenshot /tmp/page.png - Capture d'écran
  • browser-cli snapshot -D - Différence : ce qui a changé depuis la dernière capture
  • browser-cli responsive /tmp - Captures d'écran pour mobile/tablette/bureau

Le serveur démarre automatiquement au premier appel (~3s), puis les appels suivants prennent ~100-200ms. Il reste actif pendant 30 minutes, préservant les cookies, les onglets et l'état entre les commandes.

Économies de tokens

Comparaison des tokens :

  • Playwright MCP : ~1 500 tokens par appel, ~30 000 tokens pour 20 appels
  • Browser CLI : ~75 tokens par appel, ~1 500 tokens pour 20 appels

Cela représente 95 % d'économies sur la vérification du navigateur. Pour les pipelines automatisés qui effectuent plusieurs tâches par session, cela s'accumule rapidement.

Ad

Fonctionnalités au-delà de Playwright MCP

  • Inspection CSS - css @e3 padding renvoie les valeurs calculées. inspect @e3 donne le modèle de boîte complet + 16 styles clés en JSON.
  • Mutation de style en direct - style @e3 color red avec style --undo. Déboguez le CSS sans toucher au code source.
  • Différenciation des captures - snapshot -D compare les arbres ARIA avant/après.
  • Préréglages réactifs - responsive /tmp prend des captures d'écran mobile + tablette + bureau en une seule commande.
  • Profils d'authentification - handoff ouvre un Chrome visible pour la connexion manuelle SSO/MFA, resume revient au mode sans tête, auth-save admin chiffre la session (AES-256). La prochaine fois : goto-auth https://app.com/dashboard --profile admin — aucune connexion nécessaire.
  • Traitement par lots de commandes - chain [["goto","url"],["snapshot","-i"],["console"]] exécute plusieurs commandes en un seul appel.

Implémentation technique

Architecture : Agent IA → Bash → Client CLI (bin/browse.mjs) → HTTP POST (localhost) → Serveur (src/server.mjs) → API Playwright → Chromium (sans tête).

Pure Node.js. Playwright est la seule dépendance. Pas de Bun, pas de Rust, pas de surcharge MCP.

Intégration avec Claude Code

Installez globalement :

npm install -g @tuandm/browser-cli

Ajoutez à .claude/settings.json :

{
  "permissions": {
    "allow": ["Bash(browser-cli*)"]
  }
}

Ajoutez une règle dans .claude/rules/browser-cli.md indiquant à Claude d'utiliser Browser CLI au lieu de Playwright MCP. Le créateur a exécuté 5 scénarios d'évaluation et Claude a choisi la bonne commande à chaque fois avec la règle chargée.

Il est également livré en tant que plugin Claude Code (plugin.json inclus) pour une distribution future sur le marketplace.

Inspiration et technologie

Inspiré par gstack de Garry Tan, qui a été le pionnier de l'approche CLI persistante de Chromium pour les agents d'IA. L'idée centrale était que les commandes Bash sont considérablement plus efficaces en tokens que MCP pour l'automatisation du navigateur. La technologie sous-jacente est Playwright de Microsoft.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

🦀
Tools

Interné en physique chez Hugging Face : Un cadre multi-agent double les performances de Gemini sur le benchmark CritPt

Hugging Face a publié physics-intern, un framework multi-agents pour la recherche en physique théorique qui double les performances des modèles Gemini sur le benchmark CritPt et établit un nouveau SOTA face à GPT-5.5 Pro à moindre coût.

OpenClawRadar
Shieldbot : Plugin de Scan de Sécurité Open Source pour Claude Code
Tools

Shieldbot : Plugin de Scan de Sécurité Open Source pour Claude Code

Shieldbot est un scanner de sécurité open-source qui s'exécute en tant que plugin dans Claude Code, intégrant six scanners dont Semgrep avec plus de 5 000 règles, Bandit, Ruff, detect-secrets, pip-audit et npm audit. Il déduplique les résultats et génère des rapports prioritaires avec des scores de risque et des corrections de code.

OpenClawRadar
Cortex : Une couche de mémoire locale pour les agents OpenClaw avec décroissance d'Ebbinghaus
Tools

Cortex : Une couche de mémoire locale pour les agents OpenClaw avec décroissance d'Ebbinghaus

Cortex est un outil de mémoire open-source conçu pour résoudre les problèmes de compactage de contexte chez les agents OpenClaw. Il implémente les courbes d'oubli d'Ebbinghaus pour la dégradation des faits, importe d'abord à partir de fichiers et s'exécute sous la forme d'un unique binaire Go de 19 Mo avec SQLite.

OpenClawRadar
Compétence OpenClaw 'Conseils d'Attente' Affiche des Astuces d'Apprentissage Pendant les Temps d'Attente des Réponses IA
Tools

Compétence OpenClaw 'Conseils d'Attente' Affiche des Astuces d'Apprentissage Pendant les Temps d'Attente des Réponses IA

La compétence 'Waiting Tips' pour OpenClaw envoie immédiatement un conseil d'apprentissage aléatoire lorsqu'un utilisateur envoie un message, comblant ainsi les 5 à 10 secondes d'attente des réponses IA avec du contenu utile. Elle comprend 75 conseils bilingues dans cinq catégories et fonctionne sur plusieurs plateformes de messagerie.

OpenClawRadar