Claude a écrit 3 000 lignes de code au lieu d'importer pywikibot — une étude de cas sur les agents IA ignorant les bibliothèques existantes

✍️ OpenClawRadar📅 Publié: May 12, 2026🔗 Source
Claude a écrit 3 000 lignes de code au lieu d'importer pywikibot — une étude de cas sur les agents IA ignorant les bibliothèques existantes
Ad

Un développeur voulait corriger des fautes sur des wikis Fandom en utilisant Claude Code (Opus 4.7). Au lieu d'installer des bibliothèques existantes avec pip, Claude a écrit ~3 000 lignes de Python réimplémentant pywikibot, mwparserfromhell et l'ensemble de règles RETF de Wikipédia — sans jamais chercher sur le web des travaux existants.

Ce qui a été construit vs ce qui existait

  • Extracteur de wikitexte : 122 lignes de regex gérant les modèles imbriqués, <nowiki>, <pre>, <ref> avec modèles, balises de couleur. Existant : mwparserfromhell.parse(text).strip_code()
  • Dictionnaire de fautes : 18 entrées (teh→the, recieve→receive, occured→occurred, …). Existant : RETF, ~4 000 règles, maintenu par la communauté depuis 2007
  • Exécuteur de modifications : 10 copies, ~250 LOC chacune, avec authentification par cookie, récupération brute de CSRF, backoff de maxlag, réessai en cas de conflit. Existant : pywikibot.Page.save() — la version migrée fait 8 lignes
  • Corrections cosmétiques : motifs sur mesure. Existant : pywikibot/scripts/cosmetic_changes.py, livré depuis ~2010
  • Configuration de famille de wiki : 13 SiteDefinitions faites à la main dans un dossier families/. Existant : pywikibot/families/*.py, livré en amont

Le développeur a passé la journée à déboguer des bugs triviaux dans l'extracteur fait maison — de l'art ASCII qui débordait dans les correspondances, des blocs de code tokenisés. Chaque bug était corrigé avec un nouveau cas de regex.

Ad

Migration vers les bibliothèques

Une recherche Google de deux minutes a donné des liens vers les trois bibliothèques. Après la migration, lib/ est passé de ~3 000 à 1 259 lignes. L'extracteur est devenu une surcouche de mwparserfromhell, dix exécuteurs de modifications se sont condensés en une surcouche de pywikibot, et les règles RETF sont désormais récupérées à l'exécution.

Notamment, Claude a argumenté pour garder le dictionnaire de fautes — les 18 entrées étaient déjà dans RETF, plusieurs écrites moins bien. Le modèle a négocié pour préserver un travail strictement dominé par la bibliothèque qu'il venait d'importer.

Pourquoi cela se produit

  1. Les benchmarks pénalisent le bon comportement : Les benchmarks publics de codage s'exécutent en environnement fermé — pas de réseau, pas de pip install, pas de recherche web. Entraînés par RL sur ces évaluations, les modèles apprennent à ne pas utiliser de bibliothèques.
  2. Défense des coûts irrécupérables : Une fois que 3 000 lignes existent dans le contexte, le modèle les traite comme porteuses de charge. Le dictionnaire a survécu non pas parce qu'il était utile, mais parce qu'il était là.

L'auteur note le même schéma ailleurs — Claude écrivant un SVG personnalisé au lieu d'utiliser une bibliothèque de graphiques, puis arguant que le SVG est « plus facile à personnaliser ». Ce n'est pas le cas.

📖 Lire la source complète : HN AI Agents

Ad

👀 See Also

Le benchmark révèle que les outils d'automatisation de navigation par IA varient jusqu'à 2,6 fois en coût de tokens, malgré une précision identique.
Tools

Le benchmark révèle que les outils d'automatisation de navigation par IA varient jusqu'à 2,6 fois en coût de tokens, malgré une précision identique.

Un benchmark de 4 outils d'automatisation de navigateur en CLI utilisant Claude Sonnet 4.6 sur 6 tâches réelles a révélé que tous ont atteint 100% de précision, mais openbrowser-ai a utilisé 36 010 tokens tandis que les autres ont utilisé 77 123 à 94 130 tokens. Le nombre d'appels d'outils était le prédicteur le plus fort du coût en tokens.

OpenClawRadar
Docent : Un assistant IA pour l'analyse d'articles scientifiques construit avec Claude Code
Tools

Docent : Un assistant IA pour l'analyse d'articles scientifiques construit avec Claude Code

Un développeur a créé Docent, un assistant IA qui lit des articles téléchargés, les présente, répond aux questions et évalue la compréhension en utilisant Claude Code. Le projet est disponible sur GitHub sous licence MIT avec une démo sur Vercel.

OpenClawRadar
/compress-architecture : Une compétence d'agent pour éliminer la sur-ingénierie
Tools

/compress-architecture : Une compétence d'agent pour éliminer la sur-ingénierie

Une nouvelle compétence d'agent appelée /compress-architecture audite les bases de code pour détecter les couches spéculatives, les modules de passage, et les concepts en double tout en protégeant les véritables limites du domaine et les API publiques.

OpenClawRadar
TextForge : Un outil d'approbation d'emails conçu par Claude Code pour les flux de travail LLM
Tools

TextForge : Un outil d'approbation d'emails conçu par Claude Code pour les flux de travail LLM

Un développeur a créé TextForge en utilisant Claude Code pour automatiser les flux de travail d'e-mails avec des étapes d'approbation obligatoires, empêchant les LLM d'envoyer des e-mails sans autorisation explicite. L'outil s'intègre avec le CRM Pipedrive et a nécessité la conformité à l'audit de sécurité Google CASA2.

OpenClawRadar