Architecture de Prompt de Code Claude Rétro-ingéniérée pour Modèles Locaux

Un dépôt GitHub contient une réimplémentation complète et légalement propre de l'architecture de prompting de Claude Code, conçue pour les développeurs construisant des agents de codage sur des modèles locaux.
Détails clés
Le dépôt documente l'architecture complète de prompting que Claude Code utilise, initialement issue d'une brève publication publique sur npm. L'auteur a étudié chaque prompt et a utilisé Claude lui-même pour réécrire l'ensemble de la collection à partir de zéro. Le résultat est de 26 prompts au total couvrant :
- La structure du prompt système qui contrôle réellement le comportement (pas seulement "vous êtes un assistant utile")
- Les prompts d'outils qui empêchent le modèle d'utiliser le shell lorsqu'un outil dédié existe
- Les règles de sécurité qui filtrent les actions destructrices sans être trop restrictives
- La compression de mémoire pour les sessions longues (critique pour les fenêtres de contexte plus petites)
- Les modèles de vérification qui détectent quand le modèle rationalise au lieu de tester
Les prompts sont organisés en catégories : système, outils, agents, mémoire, coordination et utilitaires. Les modèles de prompts sont indépendants du modèle et peuvent être adaptés à tout modèle prenant en charge l'utilisation d'outils.
Statut légal
Chaque prompt est rédigé indépendamment avec une formulation différente. L'auteur a vérifié qu'il n'y avait aucune copie textuelle via des vérifications automatisées. Le dépôt inclut un avertissement juridique complet couvrant l'usage nominatif loyal, la non-affiliation avec Anthropic et une politique de réponse DMCA. Ceci est décrit comme une réimplémentation de style salle blanche, pas une copie.
Le projet est sous licence MIT et disponible à https://github.com/swati510/claude-code-prompts.
Cette architecture est particulièrement utile pour construire des flux de travail agentiques avec Ollama, llama.cpp ou vLLM.
📖 Lire la source complète : r/LocalLLaMA
👀 See Also

Claude Usage Monitor : Application gratuite pour macOS dans la barre de menu pour suivre les limites de Claude.ai
Un développeur a créé Claude Usage Monitor, une application gratuite pour macOS qui s'affiche dans la barre de menus et montre l'utilisation de Claude.ai avec des icônes codées par couleur, des compteurs en direct et des minuteries de réinitialisation. L'application lit directement les sessions Claude.ai sans nécessiter de clé API.

Sentrial : Surveillance de la Production pour Agents IA
Sentrial est un outil de surveillance qui détecte automatiquement les schémas de défaillance dans les produits d'IA, notamment les boucles, les hallucinations, les mauvais usages d'outils et les frustrations des utilisateurs. Il diagnostique les causes profondes en analysant les schémas de conversation, les sorties du modèle et les interactions avec les outils.

Codesight : Le Moteur de Contexte IA Réduit de 30 000 à 60 000 Tokens les Sessions de Code sur Claude
Codesight est un outil open-source qui analyse les bases de code pour fournir aux agents d'IA de codage un contexte structuré, réduisant ainsi le gaspillage de tokens. Un développeur a collaboré avec le mainteneur pour ajouter l'analyse AST pour Next.js et Prisma, une suite d'évaluation, la télémétrie des tokens et des profils pour Claude Code et Cursor.

Table Ronde IA : Outil pour Comparer Plus de 200 Modèles d'IA sur des Questions Structurées
AI Roundtable est un outil gratuit qui permet aux utilisateurs de poser des questions avec des options de réponse définies, de sélectionner jusqu'à 50 modèles parmi une base de plus de 200, et d'obtenir des réponses structurées dans des conditions identiques. Il comprend également une fonction de débat où les modèles peuvent voir le raisonnement des autres et un modèle de relecture qui résume les transcriptions.