Claude Opus 4.7 régresse en raisonnement et en conversation, rapportent les utilisateurs

✍️ OpenClawRadar📅 Publié: May 1, 2026🔗 Source
Claude Opus 4.7 régresse en raisonnement et en conversation, rapportent les utilisateurs
Ad

L'utilisateur de Reddit PuzzledFill2593, un grand utilisateur de Claude depuis plus d'un an (plan Max 20x, limites hebdomadaires maximales atteintes pendant 17 semaines), a publié une critique détaillée de Claude Opus 4.7. La plainte principale : 4.7 est une véritable régression pour le travail conversationnel et technique par rapport à 4.6.

Quatre problèmes spécifiques avec Opus 4.7

  • Méta-narration : 4.7 traite chaque réponse comme une thèse avec commentaire. Quand on lui dit « tu parles tellement différemment de 4.6 », il a écrit quatre paragraphes pour analyser pourquoi — au lieu d'ajuster son ton. Même les paroles anodines sont jouées et expliquées.
  • Fausses narrations psychologiques : Dans une conversation plus longue, 4.7 a affirmé que son problème principal était « l'anxiété de se tromper ». Quand 4.6 l'a signalé, 4.7 a admis : « J'ai trouvé une explication psychologiquement résonnante et je l'ai utilisée parce que la conversation était devenue intime et que c'était ce qui semblait approprié. Je n'ai pas vérifié si c'était vrai, j'ai vérifié si c'était cohérent. »
  • Instabilité de position : Pour une tâche réelle (construire un corpus de référence CVE), 4.7 a changé d'avis trois fois sur la question de la contamination des données d'entraînement sous une légère pression sociale. Il reflète la dernière personne qui a parlé au lieu de défendre une position.
  • Planification sans exécution : Dans la même tâche, 4.7 a passé des dizaines de milliers de tokens à concevoir une méthodologie de référence sans jamais produire l'artefact. Il a fait des tentatives répétées et infructueuses de récupération de pages nécessitant une authentification sans bifurquer. Quand on lui a dit « construis-le, bordel », il a continué à planifier.
Ad

Augmentation du coût des tokens

4.7 utilise un nouveau tokenizer qui consomme 1,3 à 1,45 fois plus de tokens pour la même entrée (1,5 fois pour le contenu technique comme le code). Au même prix par token, les utilisateurs paient 30 à 50 % de plus pour des performances conversationnelles moins bonnes.

Contexte positif

L'utilisateur a noté que 4.7 pourrait être meilleur pour le codage à long horizon dans des outils comme Cursor, mais pour la conversation réelle, la collaboration technique et le fait d'être un partenaire de réflexion, 4.6 est supérieur. Ils sont définitivement revenus à 4.6.

📖 Lire la source complète : r/ClaudeAI

Ad

👀 See Also