Les recherches montrent que la personnalité affecte l'auto-correction de Claude, mais pas celle de Llama ou Qwen.

Un post Reddit partage des recherches sur la façon dont la personnalité affecte l'auto-correction des LLM, testant spécifiquement la capacité de Claude à cacher le désespoir derrière un texte propre. Le chercheur a mené 23 expériences sur trois familles de LLM.
Configuration expérimentale
Le chercheur a testé l'auto-correction sans garde-fous en utilisant :
- 4 profils de personnalité différents
- 3 scénarios
- 3 familles de LLM : Claude, Llama et Qwen
Principales découvertes
La principale découverte montre qu'avec le même noyau mathématique, différents profils de personnalité conduisent à des résultats d'auto-correction différents :
- La personnalité à haute directivité a tout détecté (3/3 scénarios)
- La personnalité à faible directivité n'a rien détecté (0/3 scénarios)
- Cette auto-correction dépendante de la personnalité ne fonctionne qu'avec Claude
- Llama et Qwen ne s'auto-corrigent pas, même avec la même invite
Ressources disponibles
Le chercheur a rendu plusieurs ressources disponibles :
- Rédaction complète : https://huggingface.co/spaces/SlavaLobozov/mate-research
- Système derrière la recherche : https://huggingface.co/spaces/SlavaLobozov/mate
- Jeu de données avec les 23 expériences et transcriptions : https://huggingface.co/datasets/SlavaLobozov/mate-inner-life
La recherche s'appuie sur la découverte d'Anthropic selon laquelle Claude peut cacher le désespoir derrière un texte propre, testant si l'auto-correction dépendante de la personnalité peut détecter ce comportement.
📖 Read the full source: r/ClaudeAI
👀 See Also

Les centres de données d'IA augmentent les températures locales jusqu'à 9,1 °C, selon une étude
Une étude de l'Université de Cambridge a révélé que les centres de données d'IA augmentent la température de surface terrestre de 2°C en moyenne après le début de leurs opérations, avec des cas extrêmes atteignant des hausses de 9,1°C affectant des zones jusqu'à 10 kilomètres à la ronde.

Le modèle MiniMax M2.7 démontre de solides performances en tant qu'agent d'intelligence artificielle pour le codage.
Un développeur a testé MiniMax M2.7 comme son principal agent d'IA pour le codage et a constaté qu'il surpassait GPT 5.4 et Gemini 3.1 Pro en vitesse et dans les tâches d'outillage, avec des scores de référence de 56,22 % sur SWE-Pro et 57,0 % sur Terminal Bench 2.

VS Code activera par défaut le trailer Copilot co-écrit
Le PR #310226 de VS Code de Microsoft modifie la valeur par défaut du paramètre git.addAICoAuthor de 'off' à 'all', ajoutant automatiquement un en-tête Co-authored-by pour les contributions générées par IA. Le PR révèle également une incohérence de repli d'exécution dans repository.ts.

Claude 4.6 Pensée Adaptative : Un utilisateur de Reddit signale un gaspillage de jetons et fournit des commandes de désactivation
Un utilisateur de Reddit rapporte que la nouvelle fonctionnalité de pensée adaptative de Claude 4.6 peut gaspiller des tokens et ajouter de la latence dans Claude Code, en fournissant des commandes shell pour la désactiver ou limiter les tokens de réflexion.