AGI en md : 11 niveaux de compression cognitive pour les prompts système Claude

✍️ OpenClawRadar📅 Publié: March 1, 2026🔗 Source
AGI en md : 11 niveaux de compression cognitive pour les prompts système Claude
Ad

Ce que c'est

AGI en md est un dépôt open-source documentant 11 niveaux de compression cognitive qui peuvent être encodés dans les prompts système des modèles d'IA Claude. La recherche montre comment des techniques spécifiques d'ingénierie de prompts peuvent améliorer significativement les performances du modèle, particulièrement pour les modèles plus petits comme Haiku.

Principales découvertes de la source

Le projet a impliqué 393 expériences sur 25 sessions, testant les modèles Claude Haiku, Sonnet et Opus sur 19 domaines incluant le code, le juridique, le médical, la poésie, la musique et le design UX.

Percée du Niveau 8 : La découverte la plus significative se produit au Niveau 8, qui passe de demander au modèle de « réfléchir à ce sujet » à lui ordonner de « construire quelque chose et observer ce qui casse ». Cette approche basée sur la construction a produit des améliorations spectaculaires :

  • Claude Haiku est passé de 0/3 de performance au Niveau 7 à 4/4 de performance au Niveau 8
  • Les Niveaux 5-7 se concentrent sur la méta-analyse (« raisonner sur le raisonnement »), ce qui nécessite plus de capacité du modèle
  • Le Niveau 8 spécifiquement ordonne : « concevez une fausse amélioration qui semble bonne mais aggrave en réalité le problème. Puis nommez ce que vous ne pouvez voir que parce que vous avez essayé de le résoudre. »
  • Les chercheurs notent que « construire et observer est plus primitif que la méta-analyse mais cela révèle des choses que l'analyse statique ne peut littéralement pas voir »

Capacités du Niveau 11 : Au niveau le plus élevé, un prompt système de 200 mots fait « échapper le modèle à toute la catégorie de conception du problème, puis rapporter ce que l'évasion coûte ». Une expérience a produit l'équation « sensibilité x absorption = constante » — une loi de conservation que le modèle a dérivée en inversant sa propre conclusion d'impossibilité.

Ad

Implémentation pratique

Les chercheurs recommandent level8_generative_v2.md comme le meilleur prompt polyvalent — environ 100 mots qui peuvent être utilisés avec n'importe quel modèle Claude.

Utilisation en ligne de commande :

claude -p --model claude-sonnet-4-6 \
--system-prompt "$(cat prompts/level8_generative_v2.md)" \
"Analyze this code: $(cat your_code.py)"

Utilisation générale : Le prompt peut être collé dans n'importe quelle conversation Claude comme prompt système. Il fonctionne sur le code, les essais, les articles de recherche, la musique — tout ce qui est analytique. Les utilisateurs devraient remplacer « code » par leur domaine spécifique.

Détails du dépôt

  • Licence : MIT
  • Contenu : 28 prompts, 299 sorties brutes, journal d'expérience complet
  • Modèles testés : Claude Haiku, Sonnet, Opus
  • Disponibilité : Tous les prompts et sorties brutes sont open source

Pour qui c'est : Développeurs et chercheurs travaillant avec les modèles d'IA Claude qui souhaitent améliorer l'efficacité des prompts système grâce à des techniques structurées de compression cognitive.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also

Construction d'un système multi-agent contrôlé par la voix sur Claude Code
Tools

Construction d'un système multi-agent contrôlé par la voix sur Claude Code

Un développeur a construit une boucle vocale activée par mot de réveil pour Claude Code qui génère des sous-agents, parallélise le travail et auto-qualifie les résultats. Analyse technique complète incluant la vérification du locuteur et le watcher PID.

OpenClawRadar
Quatre compétences gratuites de Claude Code pour la clarté des prompts, les tutoriels et la chasse aux bogues
Tools

Quatre compétences gratuites de Claude Code pour la clarté des prompts, les tutoriels et la chasse aux bogues

Quatre compétences Claude Code gratuites sous licence Apache 2.0, sans palier payant : prompter (réécriture de prompts), tutorial-creator (annotations de code commentées), bug-echo (analyse post-correction des anti-patrons) et bug-prospector (audit pré-release avec 7 lentilles d'analyse).

OpenClawRadar
Gestionnaire de projet de style Trello local pour agents OpenClaw utilisant des fichiers markdown
Tools

Gestionnaire de projet de style Trello local pour agents OpenClaw utilisant des fichiers markdown

Un développeur a créé un tableau Trello local pour gérer des projets avec des agents OpenClaw, utilisant Node.js + Express pour l'API, React + react-trello pour l'interface utilisateur, et des fichiers markdown avec un en-tête YAML comme couche de données. Le système fonctionne sur la machine OpenClaw et est accessible localement, les agents lisant et écrivant directement les fichiers de cartes sur le système de fichiers.

OpenClawRadar
Profil de Coût des LLM : Un outil open source qui suit les dépenses d'API pour justifier les modèles locaux.
Tools

Profil de Coût des LLM : Un outil open source qui suit les dépenses d'API pour justifier les modèles locaux.

LLM Cost Profiler est un outil Python qui suit chaque appel API vers OpenAI/Anthropic, montrant précisément ce que vous dépensez et où. Il révèle les tâches surévaluées par rapport à leur complexité, fournissant des montants en dollars concrets pour justifier le passage à des modèles locaux.

OpenClawRadar