Système à 2 invites pour transporter le contexte entre les discussions Claude sans gaspillage de jetons

Un utilisateur de Reddit a publié un système pratique pour résoudre le problème de l'atteinte de la limite de longueur du chat de Claude en cours de projet. La solution utilise deux prompts : l'un pour l'extraction du contexte de l'ancien chat, l'autre pour l'initialisation dans le nouveau chat.
Le Problème
Les longues conversations avec Claude ralentissent, atteignent des limites de longueur ou deviennent coûteuses sur l'API. Les solutions de contournement courantes — résumé manuel, copier-coller de l'intégralité des chats, ou recommencer à zéro — perdent des décisions critiques, gaspillent des tokens ou nécessitent des réexplications.
Le Système
Prompt 1 : Extraction du Contexte (à coller dans l'ancien chat)
Demande à Claude de compresser l'intégralité de la conversation en un résumé structuré en 9 sections : Objectif, Contexte Clé, Décisions Prises, Travail Effectué, État Actuel, Prochaines Étapes, Questions Ouvertes/Blocages, Données/Actifs Critiques, et Style & Préférences. La sortie doit être placée dans un bloc de code propre. Longueur cible : 300–600 mots, en privilégiant les spécificités sur les généralités.
Prompt 2 : Initialisation du Chat (à coller dans le nouveau chat)
Vous collez le bloc de contexte extrait et demandez au nouveau chat de le traiter comme source de vérité. Il demande à Claude de vérifier la compréhension, de signaler les lacunes éventuelles et de reprendre à partir des Prochaines Étapes plutôt que de recommencer.
Les prompts exacts sont fournis dans la source. Par exemple, la structure de sortie du prompt d'extraction utilise ces en-têtes :
- Objectif
- Contexte Clé
- Décisions Prises (avec raisons)
- Travail Effectué
- État Actuel
- Prochaines Étapes (marquer la prochaine immédiate avec →)
- Questions Ouvertes / Blocages
- Données / Actifs Critiques
- Style & Préférences
Le prompt d'initialisation inclut : "Traitez le contexte comme établi. Ne recadrez pas et ne recommencez pas. Maintenez toutes les décisions et préférences listées." et demande une réponse de confirmation avec l'objectif, la prochaine action immédiate et les éventuelles lacunes.
À Qui Cela S'adresse
Les développeurs utilisant Claude (API ou web) qui ont besoin de poursuivre des projets de longue durée sans perdre le contexte ni brûler des tokens en explications redondantes.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

OpenClaw 2026.3.23 ajoute le fournisseur DeepSeek, le paiement à l'usage pour Qwen et des améliorations du MCP Chrome.
OpenClaw v2026.3.23 introduit un plugin fournisseur DeepSeek, une tarification à l'usage pour Qwen, une tarification automatique OpenRouter avec ordre de réflexion Anthropic, une attente des onglets Chrome MCP, et des correctifs pour Discord/Slack/Matrix et l'interface Web.

Selfware : Framework d'agent IA local basé sur Rust avec architecture PDVR
Selfware est un framework d'agent IA open-source construit en Rust pour l'inférence locale, mettant en œuvre un cycle cognitif PDVR avec 54 outils intégrés et conçu pour des tâches de longue durée sur du matériel grand public.

Wolfram Tech désormais disponible en tant qu'outil de base pour les systèmes LLM
Stephen Wolfram annonce que le langage Wolfram est désormais disponible en tant qu'outil fondamental pour les systèmes LLM, fournissant un calcul approfondi et des connaissances précises pour compléter les capacités des LLM. Cette annonce fait suite à trois ans de développement depuis la sortie initiale du plugin Wolfram pour ChatGPT en mars 2023.

GLM 5 sur Mac M3 : Observations de performance pour le codage agentique
Un utilisateur rapporte avoir exécuté GLM 5 via la quantification 4 bits de MLX sur un Mac M3 avec 512 Go de RAM, le trouvant utilisable pour le codage agentique avec un contexte inférieur à 50 000 tokens, mais notant des ralentissements significatifs au-delà de ce seuil.