Oui Flux/Non Flux : Une technique simple pour réduire les hallucinations contextuelles dans les sessions de codage IA

Une approche pratique pour maintenir la cohérence du contexte de l'IA
La technique Yes Flow/No Flow aborde un problème courant dans les interactions prolongées avec l'IA : la rupture de contexte menant à des hallucinations. L'idée centrale se concentre sur le maintien de trois types de cohérence : la cohérence d'intention, la cohérence des instructions et la cohérence du contexte.
Comprendre Yes Flow vs No Flow
Yes Flow se produit lorsque chaque réponse de l'IA s'appuie sur une base propre et cohérente. Vous lisez la sortie et pensez : "oui, c'est correct", "oui, continuez", "oui, c'est toujours aligné". Cet état crée des conversations stables dans le temps.
No Flow se produit lorsque les utilisateurs répondent aux erreurs de l'IA avec des corrections comme : "non, corrige ça", "non, réécris ça", "non, pas cette partie", "change cette ligne", "change encore cette logique". Le problème n'est pas la correction elle-même, mais le fait que chaque mauvaise réponse, chaque rejet et chaque instruction de réparation reste dans le contexte.
Le problème central et la solution
Après plusieurs tours de corrections, la cohérence se brise. L'IA ne progresse plus à partir d'une direction propre - elle essaie de deviner quelle version est réelle. Cela conduit à des tâches longues désordonnées, des sessions de codage qui s'effondrent, et des modèles qui agissent de manière étrange, confuse ou hallucinatoire.
La solution pratique : réécrire les prompts précédents au lieu d'empiler des corrections sur une sortie cassée.
Exemple d'implémentation
Au lieu de commencer par un prompt vague comme "Trouve-moi ce fichier célèbre" et ensuite corriger l'IA avec "Non, pas celui-là. Essaie encore", vous devriez :
- Utiliser le mauvais résultat comme un indice sur ce qui manquait à votre prompt original
- Réécrire le prompt avec une nouvelle clarté : "Trouve-moi ce projet GitHub bien connu lié à l'OCR"
- Maintenir un contexte plus propre et préserver la cohérence
La première mauvaise réponse n'est pas inutile - c'est un indice. Une fois que vous avez l'indice, la stratégie plus propre est d'améliorer le prompt original, pas de continuer à empiler des corrections sur la mauvaise branche.
Distinction clé
Il ne s'agit pas de ne jamais changer de demande. La question critique est : lorsque la demande change, la cohérence reste-t-elle vivante ou non ? Yes Flow protège la cohérence ; No Flow la brise lentement. Une fois que la cohérence se brise trop de fois, le modèle dépense plus d'énergie à deviner ce que vous voulez dire qu'à réellement faire la tâche.
Cette technique est particulièrement utile pour les longs chats avec l'IA, les sessions de codage, le débogage, et toute tâche nécessitant plusieurs étapes.
📖 Read the full source: r/ClaudeAI
👀 See Also

Les agents travailleurs ne devraient pas écrire directement la mémoire : un modèle Curateur-Agent
Un post Reddit détaille un pattern Memory Curator qui empêche les agents workers d'écrire directement dans la mémoire partagée, en routant les événements via une couche de validation et de cadrage.

Modèle AGENTS.md pour React Native : Claude Code génère un code plus conscient du projet
Un utilisateur de Reddit partage son fichier AGENTS.md pour les projets React Native/Expo, qui inclut la structure des dossiers, les tokens de thème, les hooks personnalisés et les patterns de composants. Résultat : Claude Code et Cursor génèrent du code utilisant les conventions exactes du projet au lieu du code React Native générique.

Dépenser 850 $ sur OpenClaw en un mois ? Corrigez votre architecture, pas votre modèle
Un développeur a dépensé 850 $ en un mois pour une configuration multi-agent OpenClaw — dont 350 $ en une seule journée. La solution n'était pas un modèle moins cher, mais une refonte de l'architecture : élagage strict du contexte, réinitialisation des sessions, n8n pour les tâches sans raisonnement et un système d'orientation entre modèles bon marché et performants.

Exécuter un agent d'IA entièrement local sur un ordinateur portable avec 6 Go de VRAM : un guide étape par étape pour les étudiants
Découvrez comment les étudiants peuvent exploiter des ordinateurs portables avec 6 Go de VRAM pour exécuter des agents d'IA localement, sans dépendre d'API coûteuses. Notre guide décompose les étapes essentielles et les outils nécessaires.