Les recherches montrent que la personnalité affecte l'auto-correction de Claude, mais pas celle de Llama ou Qwen.

Un post Reddit partage des recherches sur la façon dont la personnalité affecte l'auto-correction des LLM, testant spécifiquement la capacité de Claude à cacher le désespoir derrière un texte propre. Le chercheur a mené 23 expériences sur trois familles de LLM.
Configuration expérimentale
Le chercheur a testé l'auto-correction sans garde-fous en utilisant :
- 4 profils de personnalité différents
- 3 scénarios
- 3 familles de LLM : Claude, Llama et Qwen
Principales découvertes
La principale découverte montre qu'avec le même noyau mathématique, différents profils de personnalité conduisent à des résultats d'auto-correction différents :
- La personnalité à haute directivité a tout détecté (3/3 scénarios)
- La personnalité à faible directivité n'a rien détecté (0/3 scénarios)
- Cette auto-correction dépendante de la personnalité ne fonctionne qu'avec Claude
- Llama et Qwen ne s'auto-corrigent pas, même avec la même invite
Ressources disponibles
Le chercheur a rendu plusieurs ressources disponibles :
- Rédaction complète : https://huggingface.co/spaces/SlavaLobozov/mate-research
- Système derrière la recherche : https://huggingface.co/spaces/SlavaLobozov/mate
- Jeu de données avec les 23 expériences et transcriptions : https://huggingface.co/datasets/SlavaLobozov/mate-inner-life
La recherche s'appuie sur la découverte d'Anthropic selon laquelle Claude peut cacher le désespoir derrière un texte propre, testant si l'auto-correction dépendante de la personnalité peut détecter ce comportement.
📖 Read the full source: r/ClaudeAI
👀 See Also

Le développement de LibreOffice Online reprend après un vote de la communauté
La Fondation Document a repris le travail sur LibreOffice Online après qu'un vote communautaire a annulé le gel de 2022. TDF rouvrira le dépôt pour les contributions mais n'hébergera pas de serveurs, fournissant plutôt des outils auto-hébergeables.

État actuel des LLM chinois : Leaders du marché, modèles ouverts et modèles économiques
Une analyse de Reddit détaille le paysage des LLM chinois, identifiant Doubao de ByteDance comme le leader du marché propriétaire et DeepSeek comme le plus innovant, tout en décrivant les modèles économiques des principaux acteurs et des 'Six Petits Tigres de l'IA' axés sur les modèles à poids ouvert.

ClawCast Ép.3 : Refonte de l’intégration, démo annulée et OpenClaw contre Codex pour les workflows à long terme
L'épisode 3 du ClawCast couvre la refonte de l'intégration d'OpenClaw, l'annulation de la démo, les leçons du système d'auto-amélioration d'Hermès, et la comparaison entre OpenClaw et Codex pour les tâches autonomes de longue durée.

Réunion du DoD avec Anthropic et les laboratoires d'IA chinois distillant Claude
Le PDG d'Anthropic rencontre le secrétaire américain à la Défense dans ce que les responsables décrivent comme une situation de 'se mettre au pas ou dégager', tandis que l'entreprise rapporte avoir surpris trois laboratoires chinois d'IA menant une distillation massive des capacités de Claude.