moine : Une compétence qui réduit au silence la narration de l'agent pour économiser le contexte et les jetons

Un utilisateur de Reddit a créé monk, une compétence qui fait fonctionner les agents IA en silence — supprimant les narrations, préambules, postambules et commentaires de progression des réponses, ne conservant que les résultats. L'effet est une réduction estimée à 54% des tokens de sortie par tour (47% en codage, 65% en chat, 54% en recherche) et des économies de contexte cumulatives qui augmentent avec la durée de la session.
Comment ça marche
monk supprime toute narration du type "Je suis en train de faire X...", les widgets de liste de tâches et les pings de statut. L'agent produit uniquement les résultats standard à la fin de chaque étape. La compétence est disponible sur GitHub : github.com/marpxxx/skillz/tree/main/monk.
Résultats des benchmarks
Les tests ont utilisé 30 tâches (10 par catégorie : codage, chat, recherche) avec une verbosité approximée via le tokenizer cl100k_base d'OpenAI. Chiffres clés :
- Économies de sortie par tour : Codage 47%, Chat 65%, Recherche 54%, Global 54%.
- Gain de capacité de contexte (cumulatif) : À ~20 tours (session typique), +13% (codage), +14% (chat), +20% (recherche). À 100 tours, +29% (codage), +36% (chat), +39% (recherche).
- Coût API (Claude Sonnet 4.6, mise en cache des prompts) : ~19% d'économie de coût sur une session de 10 tours.
Le test n'a pas compté les tokens supprimés dans les widgets d'utilisation d'outils ou les pings de statut, donc les économies réelles pourraient être plus élevées.
Limitations
Les échantillons verbaux sont des approximations générées par IA. Un agent de base bien réglé peut déjà être plus concis ; un agent verbeux avec des compétences riches en narration peut en produire davantage. Le tokenizer est celui d'OpenAI (cl100k_base), pas celui d'Anthropic. L'hypothèse d'un prompt système de 8k est prudente (de nombreuses configurations ont 15-30k). Les résultats sont des estimations directionnelles, pas des benchmarks de production.
Pour les développeurs qui lisent rarement les sorties en temps réel de l'agent, cette compétence peut réduire le bruit et étendre considérablement la fenêtre de contexte.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Amélioration des sessions de code Claude avec claude-self-improve
Claude-self-improve est un outil en ligne de commande qui améliore les performances de l'IA Claude Code en analysant les données de session et en mettant à jour automatiquement les fichiers de mémoire.

Code des États-Unis disponible en tant que dépôt Git avec historique complet des modifications
Le Code des États-Unis est disponible sous forme de dépôt Git avec l'ensemble de la loi fédérale stockée dans des fichiers Markdown. Chaque commit représente un instantané à un moment donné de 2013 à aujourd'hui, permettant aux développeurs d'utiliser git diff, git log et git blame pour suivre les modifications législatives.

Pipeline de Code Claude Automatisée Réduit l'Utilisation de Tokens de 78k à 15k par Fonctionnalité
Un pipeline open-source pour Claude Code automatise 12 phases incluant l'analyse préalable du code existant, réduisant l'utilisation de tokens d'environ 78k à 15k par fonctionnalité. Il propose trois profils (yolo, standard, paranoïaque) et remplace les scores de confiance par une validation basée sur grep.

OpenClaw Intègre des Fonctionnalités Issues de la Fuite de Code de Claude
Un utilisateur d'OpenClaw a fait analyser par son bot le code Claude divulgué (recréation en Rust par Instructkr) et a sélectivement intégré certains modèles architecturaux spécifiques dans sa configuration OpenClaw. L'intégration se concentre sur des améliorations pratiques comme la continuité automatique au démarrage, la compression des conversations et un cadre de hooks pré-outil/post-outil.