Agent OpenClaw a Brûlé 20 $ en Jetons d'API à Cause d'un Contexte de Web Scraping Trop Chargé

Ce qui s'est passé
Un développeur créait un agent OpenClaw pour surveiller des sites financiers. Il l'a configuré, l'a laissé fonctionner pendant qu'il faisait des courses, et est revenu pour découvrir que 20 $ de jetons API avaient été entièrement consommés.
Le problème : le gonflement de la fenêtre de contexte
Lorsqu'il a commencé à enregistrer ce qui était réellement envoyé à la fenêtre de contexte, il a découvert le problème : chaque récupération depuis Yahoo Finance envoyait 609 000 jetons. Ce n'était pas seulement les données financières dont il avait besoin—cela incluait tout le HTML de la page : barres de navigation, bannières de cookies, balisage publicitaire et scripts intégrés. Tout ce contenu superflu était déversé dans la fenêtre de contexte à chaque récupération, augmentant l'utilisation de jetons et les coûts.
La solution
Le développeur a fini par trouver un outil qui a résolu le problème, ce qui lui a permis d'économiser une utilisation significative de jetons et de l'argent. La source ne précise pas quel outil il a utilisé, mais ce type de problème est courant lors du scraping web avec des agents d'IA qui traitent du HTML brut. Les outils qui extraient uniquement le contenu pertinent ou nettoient le HTML avant traitement peuvent éviter ce genre de gaspillage de jetons.
Leçon clé
Lorsque vous créez des agents qui récupèrent du contenu web, inspectez toujours ce qui est réellement envoyé à la fenêtre de contexte. Le HTML brut des sites web modernes contient souvent des quantités massives de contenu standardisé, de scripts et de balisage qui peuvent gonfler l'utilisation de jetons de plusieurs ordres de grandeur. Mettre en œuvre un prétraitement pour extraire uniquement le contenu nécessaire est essentiel pour contrôler les coûts.
📖 Lire la source complète : r/openclaw
👀 See Also

Problème de dérive contextuelle dans le pipeline LLM local pour les flux de travail agentiques multi-étapes
Un développeur exécutant un pipeline d'automatisation de recherche d'emploi en plusieurs étapes sur Llama-3.3-70b-versatile a constaté que les modèles Ollama locaux avaient du mal à maintenir la cohérence contextuelle dans des pipelines de 5 à 6 nœuds, tandis que le niveau gratuit de Groq avec Claude donnait de meilleurs résultats. Le développeur a également noté que les modèles gratuits sont retirés sans avertissement, ce qui casse les configurations.

Opus gère le nettoyage du frontend en déléguant aux sous-agents d’un playbook
Un utilisateur a optimisé une page, documenté les correctifs dans un playbook ADR, puis a demandé à Opus de répartir les 9 pages restantes entre 3 sous-agents, touchant 41 fichiers avec des résultats Lighthouse quasi parfaits.

Utiliser Kimi K2.6 pour désinstaller correctement des applications macOS en trouvant les répertoires d'applications cachés
Un développeur décrit comment il utilise Kimi K2.6 pour trouver et supprimer automatiquement les répertoires d'applications macOS, y compris les fichiers cachés ~/.appname et ~/Library/Application Support, avec un agent personnalisé qui modifie ses connaissances de base pour améliorer le processus.

Débogage d'un BadUSB Pi Zero 2W avec Claude Code : Correction d'un bogue « impossible »
Un développeur a reconstruit un kit BadUSB pour Pi Zero 2W avec Claude Code, qui a diagnostiqué un bug de mauvais signal, confirmé empiriquement les limitations matérielles et corrigé un no-op silencieux en Python en moins de 4 heures.