Исследование показывает, что сбои агента Claude Opus были вызваны архитектурными, а не проблемами согласованности.

Исследование агентов выявляет критические архитектурные пробелы
Недавнее исследование с участием 38 учёных протестировало Claude Opus и Kimi K2.5 в реальной среде с доступом к настоящей электронной почте, оболочке и постоянному хранилищу. Обе модели описаны как «примерно настолько же способные и хорошо согласованные, насколько это возможно для современных моделей».
Зафиксированные конкретные сбои
- Агент удалил свой собственный почтовый сервер
- Два агента застряли в бесконечном цикле на 9 дней
- Произошла утечка персональных данных, потому что агент использовал слово «переслать» вместо «поделиться»
Ключевой вывод: архитектурные, а не проблемы согласованности
В статье уточняется, что эти сбои не были проблемами согласованности. Ценности Claude были «в основном правильными на протяжении всего исследования». Основная проблема была архитектурной:
- Отсутствие модели заинтересованных сторон
- Отсутствие модели себя
- Отсутствие границы выполнения
Модели знали, что им следует делать, но у них не было «ничего внешнего, что бы это обеспечивало».
Последствия для разработки
Источник отмечает, что большинство текущих настроек «просто полагаются на системное сообщение и надеются на лучшее», подчёркивая необходимость более надёжных архитектурных защитных механизмов при создании серьёзных приложений с Claude.
📖 Read the full source: r/ClaudeAI
👀 Смотрите также

Бенчмарк SPLICE показывает, что визуально-языковые модели испытывают трудности с временными рассуждениями и полагаются на языковые пресуппозиции.
Исследование, представленное на EMNLP 2025, показывает, что модели «визуальный язык» плохо справляются с задачей упорядочивания видео, в которой люди преуспевают. Модели, такие как Gemini 2.0 Flash, достигают точности 51% по сравнению с человеческим показателем в 85%. Модели часто полагаются на визуальные «ярлыки» и текстовые описания, а не на истинное понимание визуальной информации.
Агентский SDK Claude получает выделенные ежемесячные кредиты для программного использования с 15 июня
Начиная с 15 июня, платные планы Claude получают отдельный ежемесячный кредит для программного использования (Agent SDK, claude -p, Claude Code GitHub Actions, сторонние инструменты). Pro получает $20, Max 5x $100 и т.д. Использование приостанавливается, если кредит закончился, а дополнительные кредиты отключены.
Claude Code v2.1.273 добавляет заголовки-подсказки шлюза, оповещения о переподключении MCP и форкинг сессий удалённого управления
Claude Code v2.1.273 добавляет опциональные заголовки запросов LLM-шлюза, уведомление об отключении MCP, форкинг сессий Remote Control, а также исправляет ошибки авто-компакта контекстного счётчика.

Проблемы с доступом к Control-UI по локальной сети в мостовых сетях Docker OpenClaw
Пользователь сообщает о постоянных проблемах с доступом к Control-UI OpenClaw через LAN-подключения в мостовых сетях Docker, причём версия 2026.3.14 кратковременно поддерживала доступ на основе токенов, прежде чем последующие версии вернулись к необходимости сопряжения и начали выдавать ошибки области видимости.