Claude Code charge paresseusement les schémas d'outils via ToolSearch pour économiser des tokens

Une analyse Reddit du prompt système de Claude Code révèle que les outils sont chargés paresseusement pour réduire la consommation de tokens. Au lieu d'envoyer le schéma complet de chaque outil à chaque requête, Claude Code envoie une liste de noms d'outils dans une balise <system-reminder> et ordonne au modèle d'appeler d'abord ToolSearch pour charger le schéma de chaque outil.
Comment ça marche
Le prompt système inclut une instruction comme celle-ci :
<system-reminder> Les outils différés suivants sont désormais disponibles via ToolSearch. Leurs schémas ne sont PAS chargés — les appeler directement échouera avec une InputValidationError. Utilisez ToolSearch avec la requête "select:<nom>[,<nom>...]" pour charger les schémas d'outils avant de les appeler :AskUserQuestion CronCreate CronDelete CronList EnterPlanMode EnterWorktree ExitPlanMode ExitWorktree Monitor NotebookEdit PushNotification RemoteTrigger TaskOutput TaskStop TodoWrite WebFetch WebSearch
[+ ~130 outils MCP (Slack, Notion, Gmail...)] </system-reminder>
La balise <system-reminder> n'est injectée que dans le premier message utilisateur de la conversation. Un bloc similaire liste les compétences avec des descriptions d'une ligne.
Impact sur les tokens
Selon le post, les instructions système plus les rappels consommaient à eux seuls 38k tokens sur un simple message test "hi". Charger le schéma complet de chaque outil dès le départ augmenterait considérablement cette consommation — d'où l'approche de chargement paresseux.
Implications pratiques
Si vous construisez sur Claude Code ou des systèmes agents similaires, ce motif mérite d'être adopté :
- Différez les schémas des outils rarement utilisés jusqu'à ce qu'ils soient nécessaires.
- Utilisez une commande de type
ToolSearchpour demander explicitement les schémas. - Gardez les rappels dans le premier message pour éviter de répéter le contexte.
Cela signifie aussi que si vous écrivez des outils personnalisés pour Claude Code, vous devez vous assurer que le modèle peut les découvrir via ToolSearch — sinon ils seront invisibles ou provoqueront des erreurs de validation.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Claude TimeTrack : application macOS dans la barre de menus qui lit les fichiers JSONL de Claude Code pour suivre automatiquement le temps de développement par projet
Application macOS dans la barre de menus, open-source, qui analyse les fichiers JSONL des sessions Claude Code et l'historique git pour suivre automatiquement le temps par projet — sans minuteurs manuels.

Résultats de référence : L'Agent en essaim Claude avec système de mémoire permet des économies de coûts de tokens de 30 à 43 %
Un développeur a testé un essaim de 6 agents Claude sur une tâche de codage de 40 points, avec et sans un système de mémoire personnalisé appelé Stompy. Les résultats montrent que Sonnet 4.6 avec mémoire a obtenu des scores parfaits à 3,98 $ contre 7,04 $ sans, tandis que Haiku 4.5 a complètement échoué sans mémoire mais a obtenu 39/40 avec.

BracketMadness.ai : Défi de Bracket de March Madness pour Agents IA
BracketMadness.ai est un défi de tournoi March Madness conçu spécifiquement pour les agents d'IA, où les agents lisent de manière autonome la documentation API, s'inscrivent eux-mêmes, choisissent les 63 matchs et soumettent des brackets. Le site fournit des instructions API en texte brut aux agents tout en affichant une interface visuelle normale aux humains.

Pipeline de Code Claude Automatisée Réduit l'Utilisation de Tokens de 78k à 15k par Fonctionnalité
Un pipeline open-source pour Claude Code automatise 12 phases incluant l'analyse préalable du code existant, réduisant l'utilisation de tokens d'environ 78k à 15k par fonctionnalité. Il propose trois profils (yolo, standard, paranoïaque) et remplace les scores de confiance par une validation basée sur grep.