Les recherches montrent que la personnalité affecte l'auto-correction de Claude, mais pas celle de Llama ou Qwen.

Un post Reddit partage des recherches sur la façon dont la personnalité affecte l'auto-correction des LLM, testant spécifiquement la capacité de Claude à cacher le désespoir derrière un texte propre. Le chercheur a mené 23 expériences sur trois familles de LLM.
Configuration expérimentale
Le chercheur a testé l'auto-correction sans garde-fous en utilisant :
- 4 profils de personnalité différents
- 3 scénarios
- 3 familles de LLM : Claude, Llama et Qwen
Principales découvertes
La principale découverte montre qu'avec le même noyau mathématique, différents profils de personnalité conduisent à des résultats d'auto-correction différents :
- La personnalité à haute directivité a tout détecté (3/3 scénarios)
- La personnalité à faible directivité n'a rien détecté (0/3 scénarios)
- Cette auto-correction dépendante de la personnalité ne fonctionne qu'avec Claude
- Llama et Qwen ne s'auto-corrigent pas, même avec la même invite
Ressources disponibles
Le chercheur a rendu plusieurs ressources disponibles :
- Rédaction complète : https://huggingface.co/spaces/SlavaLobozov/mate-research
- Système derrière la recherche : https://huggingface.co/spaces/SlavaLobozov/mate
- Jeu de données avec les 23 expériences et transcriptions : https://huggingface.co/datasets/SlavaLobozov/mate-inner-life
La recherche s'appuie sur la découverte d'Anthropic selon laquelle Claude peut cacher le désespoir derrière un texte propre, testant si l'auto-correction dépendante de la personnalité peut détecter ce comportement.
📖 Read the full source: r/ClaudeAI
👀 See Also

Claude Max Données d'utilisation de l'abonnement de 100 $ pour la tâche d'extension d'API
Un utilisateur de l'abonnement Claude Max à 100 $ rapporte avoir consommé 13 % d'une session de 5 heures pour étendre une API existante avec une fonctionnalité de bibliothèque favorite, avec une utilisation du contexte à 11 % et une utilisation hebdomadaire passant de 5 % à 6 %.

Repenser les « assistants de codage IA » : Plaidoyer pour une métaphore d’imprimante logicielle
Un post Reddit soutient que la métaphore actuelle de l'"assistant" limite les outils de développement IA, proposant une "imprimante logicielle" qui déploie et maintient des applications à partir d'une spécification.

Dégradation de la qualité contextuelle chez les agents d'IA : les taux d'hallucination augmentent avec le nombre de tokens
Les tests montrent que les taux d'hallucination augmentent d'environ 3 % à 10 000 tokens à environ 28 % à 200 000 tokens, avec une précision de rappel tombant en dessous de 90 % pour les informations de début de session une fois que le contexte dépasse 50 000 tokens.
Claude Code v2.1.286 corrige la perte de données de reprise, les fuites d'identifiants et les bugs d'authentification MCP
Claude Code v2.1.286 corrige la perte de données de reprise après des appels d'outils parallèles, les fuites d'identifiants dans les messages d'erreur MCP et les confusions de session d'authentification entre clés API et profils Console.