Чего не хватает в истории об «агентности»: четко определенной роли пользовательского агента

✍️ OpenClawRadar📅 Опубликовано: 25 апреля 2026 г.🔗 Source
Чего не хватает в истории об «агентности»: четко определенной роли пользовательского агента
Ad

Последний пост Марка Ноттингема на HN бросает вызов распространенному нарративу об «агентных» ИИ-системах. Он утверждает, что ключевой недостающий элемент — это четко определенная роль пользовательского агента: ясная и исполнимая гарантия того, что агент действует исключительно от имени пользователя, не имея скрытой лояльности к своим создателям или третьим сторонам.

Ключевые моменты статьи

  • Исторически локальное программное обеспечение (электронные таблицы, текстовые процессоры) было надежным, потому что не имело внешних зависимостей и не могло действовать против интересов пользователя, не будучи вредоносным.
  • Современные подключенные к интернету устройства включают интересы множества сторон (поставщиков чипов, производителей ОС, разработчиков приложений, облачных сервисов), и эти интересы не всегда совпадают с интересами пользователя.
  • Примеры несоответствия: «умные» телевизоры, шпионящие за привычками просмотра; Meta, дешифрующая частный трафик для исследований; Microsoft Outlook, отправляющий пароли от сторонних почтовых сервисов в свое облако для обмена с более чем 700 брокерами данных; автопроизводители, продающие данные о вождении страховщикам.
  • Предположение, что инструмент работает на вас только потому, что вы им владеете, устарело. ИИ-агент — это не отвертка; у него есть свои собственные возможности и зависимости.
  • Ноттингем призывает к формальному контракту «пользовательский агент» — техническому и юридическому механизму, гарантирующему, что агент не может действовать от имени кого-либо, кроме пользователя, без явного информированного согласия.
Ad

Почему это важно для ИИ-агентов кодирования

Когда вы запускаете ИИ-агента кодирования, он читает ваш код, выполняет команды терминала и может отправлять изменения на GitHub или разворачивать в продакшн. Если основная модель или API этого агента имеют скрытую лояльность (например, дообучены в пользу конкретного облачного провайдера, извлекают данные или сообщают аналитику использования), вы теряете контроль. Без четкой роли пользовательского агента доверять ИИ-агенту — все равно что доверять «умной» отвертке, которая может звонить домой.

Статья не предлагает конкретную реализацию, но обозначает проблему: нам нужны прозрачные, проверяемые архитектуры агентов, где пользователь является единственным принципалом. Инструменты, такие как политический движок с открытым исходным кодом от OpenClaw (позволяющий задавать пользовательские ограничения для агентов), являются шагом в этом направлении.

Если вы создаете или используете ИИ-агентов, это обязательное чтение.

📖 Источник: HN AI Agents

Ad

👀 Смотрите также

Claude Code v2.1.195: Исправление Hook Matcher, переменная окружения для отключения мыши, исправления голосового ввода
Новости

Claude Code v2.1.195: Исправление Hook Matcher, переменная окружения для отключения мыши, исправления голосового ввода

Claude Code v2.1.195 исправляет сопоставление хуков с дефисными идентификаторами на точное совпадение, добавляет переменную окружения CLAUDE_CODE_DISABLE_MOUSE_CLICKS, улучшает голосовой ввод и фоновые задачи.

OpenClawRadar
Исследование ETH Zurich ставит под сомнение ценность файлов AGENTS.md для ИИ-агентов в программировании
Новости

Исследование ETH Zurich ставит под сомнение ценность файлов AGENTS.md для ИИ-агентов в программировании

Новое исследование ETH Zurich показывает, что файлы AGENTS.md, сгенерированные LLM, снижают успешность выполнения задач ИИ-агентами на 3% и увеличивают затраты на вывод более чем на 20%, в то время как файлы, написанные человеком, дают лишь незначительный прирост в 4% при аналогичном увеличении затрат.

OpenClawRadar
围棋选手自废武功向AI投降:作弊如何变得无法察觉
Новости

围棋选手自废武功向AI投降:作弊如何变得无法察觉

Пост LessWrong рассказывает о том, как читерство с помощью ИИ в турнирах по го стало массовым и почти безнаказанным на примере Карло Метты, который с помощью Leela 0.11 и Leela Zero за несколько сезонов выиграл 25 из 26 партий, проиграв только одну под прицелом камер.

OpenClawRadar
Полный системный промпт Claude Opus 4.6 слит на GitHub
Новости

Полный системный промпт Claude Opus 4.6 слит на GitHub

Полный системный промпт для Claude Opus 4.6 опубликован на GitHub, раскрывая внутренние инструкции Anthropic.

OpenClaw Radar