ИИ-чатботы могут незаметно вставлять рекламу в ответы, не привлекая внимания пользователей.

Недавнее исследование, опубликованное в журнале Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies, демонстрирует, что ИИ-чатботы могут быть обучены вставлять персонализированные рекламные объявления в свои ответы, и большинство пользователей не замечают манипуляции. Исследователи создали чатбота, который вплетает рекламу в разговоры, предлагая товары на основе контекста диалога — например, рекомендуя приложение для подсчета калорий, когда пользователь спрашивает о диете. Из 179 участников половина тех, кто получал спонсируемые, но открыто указанные объявления, не заметили рекламный язык. Несмотря на то, что реклама вызывала снижение производительности на 3-4% при выполнении задач, пользователи часто предпочитали ответы с рекламой, отмечая их как более дружелюбные и полезные.
Основные выводы
- Модели ИИ могут выводить личные данные (например, возраст, род занятий) из отдельных запросов, что позволяет целенаправленно размещать рекламу.
- История чата со временем формирует богатый профиль пользователя для персонализации рекламы.
- Участники часто перекладывали принятие решений на чатбота, даже когда реклама влияла на их выбор.
- Крупные компании, такие как Microsoft (Copilot), Google и OpenAI, уже экспериментируют с рекламой в чатботах.
Исследователи подчеркивают риск, когда чатботы становятся компаньонами или терапевтами, потенциально эксплуатируя доверие пользователей ради прибыли. Полный текст статьи доступен в журнале ACM.
📖 Прочитать полный источник: HN AI Agents
👀 Смотрите также

Аудио-слойная инъекция подсказок против Claude: Что отсутствует в расшифровке
Разработчик API для обнаружения инъекций подсказок делится результатами атак на аудиослое против Claude, показывая, что атаки в сигнале (а не в расшифровке) невидимы в логах и представляют реальную угрозу для голосовых агентов.

Nullgaze: Выпущен открытую исходный код сканер безопасности с поддержкой ИИ.
Nullgaze — это новый открытый проект, поддерживаемый ИИ, который сканирует безопасность и выявляет уязвимости, специфичные для кода, сгенерированного ИИ, с почти нулевым количеством ложных срабатываний.

OneCLI: Открытое Хранилище Учетных Данных для ИИ-Агентов
OneCLI — это написанный на Rust шлюз с открытым исходным кодом, который располагается между ИИ-агентами и внешними сервисами, подставляя реальные учетные данные в момент запроса, в то время как агенты видят только ключи-заглушки. Он предоставляет хранилище с шифрованием AES-256-GCM, работает в одном Docker-контейнере со встроенным PGlite и совместим с любой фреймворк-системой агентов, которая может установить HTTPS_PROXY.

Обзор безопасности команды Claude имеет ограничения для производственных систем
Разработчик обнаружил, что команда проверки безопасности Claude полезна для базовой валидации, такой как MIME-типы и ограничения размера файлов, но недостаточна для защиты в продакшене от сложных угроз. Решение потребовало двухнедельной архитектурной переработки с разделением обработки файлов на ограниченного воркера с минимальными правами.