120 modèles de prompts testés : 8 fonctionnent vraiment pour Claude Code

Un utilisateur sur r/ClaudeAI a passé 3 mois à collecter et tester plus de 120 modèles de prompt pour Claude Code, provenant de Discord, GitHub, Twitter/X et de son usage personnel. Les résultats sont documentés dans une antisèche PDF présentant 8 modèles qui modifient sensiblement la sortie, ainsi que 5 prompts de validation post-réponse. Aucune approbation officielle d'Anthropic — juste des constats empiriques de la communauté.
Les 8 modèles qui fonctionnent
- L99 — Élimine le langage hésitant comme "pourrait", "peut-être", "je pense". À placer tôt dans le prompt.
- /ghost — Supprime la voix IA générique pour une sortie plus humaine.
- OODA — Structure les réponses en Observer → Orienter → Décider → Agir. Efficace pour les tâches complexes en plusieurs étapes.
- PERSONA — Les personas spécifiques surpassent les vagues. Exemple : "Ingénieur cloud senior qui a migré 50 entreprises" bat "expert".
- /noyap — Arrête l'enthousiasme non sollicité ("Excellente question ! Absolument !"). Économise des tokens.
- ULTRATHINK — Force un raisonnement plus profond. Latence élevée mais utile pour les décisions d'architecture.
- /skeptic — Fait argumenter Claude contre sa propre réponse. Détecte les angles morts.
- HARDMODE — Ajoute des contraintes artificielles. Étonnamment efficace pour le débogage.
Prompts de validation
L'auteur inclut également 5 prompts à exécuter après la réponse de Claude, avant d'utiliser la sortie. Favori de la communauté : "évalue ta confiance du plus faible au plus fort" — réduirait les erreurs techniques d'environ 70 %.
Enseignements pratiques
Les modèles sont empiriques — les résultats peuvent varier. Le PDF est en mode sombre, facile à parcourir et conçu pour une référence rapide ou un partage en équipe. L'auteur prévoit déjà une deuxième série basée sur les retours de la communauté.
Pour les développeurs utilisant Claude Code quotidiennement, ces modèles offrent des leviers concrets pour contrôler le ton, la profondeur et la fiabilité sans dépendre de la documentation officielle.
📖 Lire la source complète : r/ClaudeAI
👀 See Also

Les frameworks d'agents gaspillent plus de 350 000 jetons par session en renvoyant des fichiers statiques.
Un benchmark sur une configuration locale Qwen 3.5 122B a révélé que les frameworks d'agents gaspillent plus de 350 000 tokens par session en renvoyant des fichiers statiques. Une approche de compilation a réduit le contexte de requête de 1 373 tokens à 73, réalisant une réduction de 95 %.

Apfel : Outil CLI gratuit pour accéder au LLM sur appareil d'Apple sur macOS
Apfel v0.6.13 est un binaire Swift 6.3 qui expose le LLM intégré d'Apple sous forme d'outil CLI, de serveur compatible OpenAI et de chat interactif. Il fonctionne à 100 % sur l'appareil sans clés API ni frais, utilisant le modèle à 4 096 tokens livré avec macOS 26+ sur les Mac à puce Apple Silicon.
GLiGuard : Modèle de modération de sécurité open source de 300M paramètres revendiquant un gain de vitesse 16x par rapport aux garde-fous LLM
Fastino Labs publie GLiGuard, un modèle basé sur encodeur de 300 millions de paramètres qui effectue plusieurs tâches de sécurité en un seul passage, égalant ou dépassant des modèles 23 à 90 fois plus grands tout en étant jusqu'à 16 fois plus rapide.

Développement local d'IA avec Qwen3.6-27B et Opencode sur un 5090
Un utilisateur de Reddit partage son expérience de transition des outils de codage IA cloud (Claude Code, Cursor) vers une configuration locale utilisant Opencode + llama-server + Qwen3.6-27B avec un contexte de 128K sur une seule RTX 5090, citant la liberté vis-à-vis des limites d'utilisation et des risques liés aux comptes.