Claude AI passe 81 minutes sur une « vraie réflexion » – Les rapports d'utilisateurs augmentent lors des mises à jour majeures

Un utilisateur de Reddit rapporte que Claude AI a récemment passé 1 heure et 21 minutes de « réflexion réelle » sur une tâche simple, produisant un bon résultat. L'utilisateur émet l'hypothèse d'un schéma récurrent : les performances semblent grimper pendant les 1 à 2 heures suivant une mise à jour majeure ou une nouvelle fonctionnalité, puis reviennent à la normale.
Observations clés
- Le mois dernier, le même utilisateur a créé un fil de recherche qui a scanné avec succès 5 113 sources (lié dans le post original).
- Depuis, il n'a pas réussi à reproduire ce niveau de performance – les tentatives suivantes scannent au maximum 100 à 200 sources et donnent des résultats moyens.
- L'utilisateur suppose que les premiers utilisateurs des nouvelles fonctionnalités reçoivent parfois un boost « mythique » de capacités de raisonnement, qui se normalise ensuite.
Cette preuve anecdotique suggère que le mode « réflexion réelle » de Claude peut être sujet à des variations côté serveur, possiblement dues à la mise en cache des modèles, à l'allocation des ressources de calcul ou au déploiement progressif des mises à jour. Les développeurs qui utilisent Claude AI pour des tâches de recherche approfondie devront peut-être tenir compte de cette incohérence, en considérant les fonctionnalités en accès anticipé comme un pic au mieux, et non comme une capacité garantie.
📖 Lire la source complète : r/ClaudeAI
👀 See Also
Coût environnemental de l'IA : 945 TWh d'électricité, l'eau de 1,3 milliard de personnes d'ici 2030
Un rapport de l'Université des Nations Unies quantifie l'empreinte de l'IA en 2030 : 945 TWh d'électricité, une consommation d'eau équivalente aux besoins de l'Afrique subsaharienne, et une surface de terrain deux fois supérieure à celle de Jakarta.

Analyse approfondie de la quantification du cache KV de Qwen : PPL, divergence KL et résultats asymétriques K/V
Deuxième série de benchmarks sur Qwen 3.6-35B-A3B avec quantification du cache KV : perplexité, divergence KL, combinaisons K/V asymétriques et profondeur de contexte 64K sur Apple M5 Max.

Claude Cowork pour Windows ARM64 publié avec un vérificateur de compatibilité
Anthropic a rendu Claude Cowork disponible pour les appareils Windows ARM64, nécessitant Windows 11 Pro avec Hyper-V et la virtualisation activée. L'entreprise fournit un outil de vérification de compatibilité EXE pour vérifier les exigences système.

Opus 4.6 Moyen vs Faible : Différences de Performance et Tarification
Opus 4.6 moyen coûte environ 50 % de plus que la version basse, mais résout d'importants problèmes de paresse observés dans le modèle peu puissant. La version moyenne se situe entre les versions basse et haute dans les benchmarks de performance.