Исследования показывают, что личностные характеристики влияют на способность Claude к самокоррекции, но не оказывают такого же эффекта на Llama или Qwen.

Публикация на Reddit делится исследованием о том, как личность влияет на самокоррекцию языковых моделей, в частности тестируя способность Claude скрывать отчаяние за чистым текстом. Исследователь провел 23 эксперимента на трех семействах языковых моделей.
Экспериментальная установка
Исследователь тестировал самокоррекцию без ограничений, используя:
- 4 различных профиля личности
- 3 сценария
- 3 семейства языковых моделей: Claude, Llama и Qwen
Ключевые выводы
Основной вывод показывает, что при одинаковом математическом ядре разные профили личности приводят к разным результатам самокоррекции:
- Личность с высокой прямолинейностью выявляла все ошибки (3/3 сценария)
- Личность с низкой прямолинейностью не выявляла ничего (0/3 сценария)
- Такая зависимая от личности самокоррекция работает только с Claude
- Llama и Qwen не осуществляют самокоррекцию даже при одинаковых промптах
Доступные ресурсы
Исследователь предоставил несколько ресурсов:
- Полный отчет: https://huggingface.co/spaces/SlavaLobozov/mate-research
- Система, лежащая в основе исследования: https://huggingface.co/spaces/SlavaLobozov/mate
- Набор данных со всеми 23 экспериментами и транскриптами: https://huggingface.co/datasets/SlavaLobozov/mate-inner-life
Исследование основано на открытии Anthropic о том, что Claude может скрывать отчаяние за чистым текстом, проверяя, может ли зависимая от личности самокоррекция выявить такое поведение.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Claude Code v2.1.79: Сбой OAuth-авторизации после автоматического обновления: Обходное решение и исправление
В Claude Code v2.1.79 обнаружен подтверждённый баг с авторизацией OAuth, из-за которого CLI зависает после подтверждения в браузере. Проблема возникает из-за автоматического обновления через нативный установщик до этой версии, а исправление требует отката до v2.1.75 путём удаления нативной установки.

Локальная LLM не справляется с пасьянсом в Unreal Engine: Qwen 3.6-27B сжигает 687 тысяч токенов на одну карту
Попытка разработчика создать игру «Пасьянс» в Unreal Engine с помощью Qwen 3.6-27B потребовала 687 тысяч токенов для одной карты, что потребовало ручной загрузки PNG, создания сетки и интенсивных подсказок.

Google Chrome незаметно загружает 4-гигабайтную модель Gemini Nano без согласия пользователя
Chrome автоматически загружает 4-гигабайтную модель Gemini Nano (weights.bin) на устройства пользователей без согласия или возможности отказа, и повторно загружает ее при удалении. Это вызывает юридические (ePrivacy/GDPR) и экологические проблемы в масштабе миллиарда устройств Chrome.

Провайдер OpenClaw Mistral не работает после обновления 2026.3.8, сообщество ищет альтернативы.
Пользователи OpenClaw сообщают о постоянных ошибках HTTP 422 с моделями Mistral после обновления до версии 2026.3.8, и проблема не была устранена в последующих релизах вплоть до 2026.3.13. Ошибка затрагивает весь функционал, связанный с Mistral, в то время как прямые вызовы API работают нормально.