Sous-programmes d'IA : Automatisation Déterministe du Navigateur sans Coût de Token

✍️ OpenClawRadar📅 Publié: April 19, 2026🔗 Source
Sous-programmes d'IA : Automatisation Déterministe du Navigateur sans Coût de Token
Ad

Ce que font les sous-programmes IA

Les sous-programmes IA enregistrent les tâches de navigateur une fois et les sauvegardent comme outils appelables qui se rejouent sans coût en tokens, sans délai d'inférence LLM et avec 100 % de déterminisme. Le script généré s'exécute dans la page web elle-même, et non via un proxy, un worker headless ou une solution hors processus.

Décision architecturale clé

Le script s'exécute dans le contexte d'exécution de la page web, ce qui signifie que toutes les authentifications, jetons CSRF, sessions TLS et en-têtes signés sont automatiquement ajoutés aux requêtes. Aucune installation de certificat, modification d'empreinte TLS ou maintenance de pile d'authentification séparée n'est requise.

Mécanisme d'enregistrement

Pendant l'enregistrement, l'extension intercepte les requêtes réseau en utilisant deux couches :

  • Correctif fetch/XHR du monde PRINCIPAL installé avant l'exécution de tout script de page
  • L'API webRequest de Chrome comme solution de secours corrélée pour les chemins CORS et service-worker

Les corps de requête, y compris FormData, Blob et les octets bruts, sont capturés, pas seulement le JSON.

Traitement de la capture réseau

Le système note et réduit environ 300 requêtes à environ 5 en fonction de plusieurs signaux :

  • Origine première partie vs tierce partie (+20 / −15)
  • Hôtes de télémétrie connus (Sentry, Segment, Hotjar, RUM) : −80
  • Corrélation temporelle avec les événements DOM (+28 dans les 800 ms, +16 dans les 2,5 s)
  • Méthode et forme de la charge utile (POST/PUT/PATCH/DELETE mutateurs : +35 ; GET : +5 ; avec corps de requête : +8)
  • Qualité de la réponse (2xx : +12 ; 4xx+ : −25 ; corps non vide : +4)
  • Identifiants d'opération volatils (−18) pour queryId GraphQL, doc_id, operationHash

Les identifiants d'opération GraphQL volatils déclenchent une solution de secours DOM uniquement avant qu'ils ne cessent silencieusement de fonctionner lors de la prochaine exécution.

Ad

Structure du code généré

Le code généré combine les appels réseau avec les actions DOM (cliquer, taper, trouver) dans la même fonction via un espace de noms d'aide rtrvr.*. Les cinq premières requêtes classées ainsi que les interactions DOM sont rendues dans un contexte de 12 000 caractères pour le générateur.

Modèle d'utilisation

Pointez un agent IA vers une feuille de calcul de 500 lignes, et avec un seul appel LLM, les paramètres sont attribués et 500 sous-programmes sont lancés.

Cas d'utilisation clés

  • Enregistrez l'envoi d'un DM Instagram, puis utilisez une routine réutilisable pour envoyer des DM sans coût en tokens
  • Créez une routine pour obtenir les derniers produits d'un catalogue de site, appelez-la pour obtenir des milliers de produits via des requêtes GraphQL directes
  • Configurez une routine pour remplir des formulaires EHR basés sur des paramètres, avec l'IA inférant les paramètres à partir du contexte de la page actuelle
  • Réutilisez des routines quotidiennement pour synchroniser les messages sortants sur LinkedIn/Slack/Gmail vers un CRM en utilisant un serveur MCP

Pourquoi c'est important

Le problème fondamental des agents de navigateur pour les tâches répétitives est que passer par la boucle d'inférence est inutile. Enregistrer une fois et faire générer à l'LLM un script qui exploite toutes les méthodes d'interaction possibles (appels API directs, interactions DOM, outils/API/serveurs MCP tiers) fournit une automatisation déterministe et rentable.

📖 Read the full source: HN LLM Tools

Ad

👀 See Also

ClaudeMeter : Application macOS Open-Source pour la Barre de Menu, Suivi en Temps Réel de l'Utilisation de Claude
Tools

ClaudeMeter : Application macOS Open-Source pour la Barre de Menu, Suivi en Temps Réel de l'Utilisation de Claude

ClaudeMeter est une application gratuite et open-source pour la barre de menus macOS destinée aux abonnés Claude Max, qui affiche les pourcentages d'utilisation par session et par semaine, des minuteries de réinitialisation et des indicateurs de rythme, sans interrompre le flux de travail. L'application entière a été construite en utilisant Claude (Claude Code/Opus) pour le code Swift, un backend Supabase et des Edge Functions.

OpenClawRadar
Palissade : Un Nouvel Outil d'Orchestration pour le Code Claude avec Support des Canaux et Couches de Sécurité
Tools

Palissade : Un Nouvel Outil d'Orchestration pour le Code Claude avec Support des Canaux et Couches de Sécurité

Stockade est un outil d'orchestration construit autour du SDK Agent d'Anthropic qui fournit une gestion de session basée sur les canaux, un contrôle d'accès basé sur les rôles (RBAC) et des autorisations granulaires pour les agents IA. Il répond aux limitations d'OpenClaw et de NanoClaw en offrant plus de contrôle tout en maintenant la sécurité grâce à la conteneurisation et aux mandataires d'identification.

OpenClawRadar
Claude-Skills Maintainer Sollicite des Retours sur la Bibliothèque de 181 Agent Skills
Tools

Claude-Skills Maintainer Sollicite des Retours sur la Bibliothèque de 181 Agent Skills

Reza, le mainteneur de claude-skills, sollicite les retours de la communauté sur sa bibliothèque open-source qui contient 181 compétences d'agent, 250 outils Python et 15 personnages d'agent fonctionnant sur 11 outils de codage IA. Il s'interroge sur l'efficacité de l'approche par compétences isolées et souhaite des avis sur les compétences manquantes, les agents basés sur des personnages et les intégrations d'outils.

OpenClawRadar
Hypura : Planificateur d'inférence LLM optimisé pour les niveaux de stockage des puces Apple Silicon
Tools

Hypura : Planificateur d'inférence LLM optimisé pour les niveaux de stockage des puces Apple Silicon

Hypura est un planificateur d'inférence basé sur Rust qui répartit les tenseurs du modèle entre les niveaux GPU, RAM et NVMe pour exécuter des modèles dépassant la mémoire physique sur les Mac à puce Apple Silicon. Il permet d'exécuter un Mixtral 8x7B de 31 Go sur un Mac Mini 32 Go à 2,2 tok/s et un Llama 70B de 40 Go à 0,3 tok/s là où llama.cpp standard plante.

OpenClawRadar