ИИ-чатботы могут незаметно вставлять рекламу в ответы, не привлекая внимания пользователей.

Недавнее исследование, опубликованное в журнале Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies, демонстрирует, что ИИ-чатботы могут быть обучены вставлять персонализированные рекламные объявления в свои ответы, и большинство пользователей не замечают манипуляции. Исследователи создали чатбота, который вплетает рекламу в разговоры, предлагая товары на основе контекста диалога — например, рекомендуя приложение для подсчета калорий, когда пользователь спрашивает о диете. Из 179 участников половина тех, кто получал спонсируемые, но открыто указанные объявления, не заметили рекламный язык. Несмотря на то, что реклама вызывала снижение производительности на 3-4% при выполнении задач, пользователи часто предпочитали ответы с рекламой, отмечая их как более дружелюбные и полезные.
Основные выводы
- Модели ИИ могут выводить личные данные (например, возраст, род занятий) из отдельных запросов, что позволяет целенаправленно размещать рекламу.
- История чата со временем формирует богатый профиль пользователя для персонализации рекламы.
- Участники часто перекладывали принятие решений на чатбота, даже когда реклама влияла на их выбор.
- Крупные компании, такие как Microsoft (Copilot), Google и OpenAI, уже экспериментируют с рекламой в чатботах.
Исследователи подчеркивают риск, когда чатботы становятся компаньонами или терапевтами, потенциально эксплуатируя доверие пользователей ради прибыли. Полный текст статьи доступен в журнале ACM.
📖 Прочитать полный источник: HN AI Agents
👀 Смотрите также

OpenClaw Security: 13 практических шагов для защиты вашего ИИ-агента
В посте на Reddit изложены 13 мер безопасности для установок OpenClaw, включая запуск на отдельной машине, использование Tailscale для изоляции сети, изоляцию под-агентов в Docker и настройку белых списков для доступа пользователей.

Атака FlyTrap использует "враждебные зонтики" для компрометации автономных дронов на основе камер.
Исследователи из UC Irvine разработали FlyTrap — физическую атаку, использующую раскрашенные зонты для эксплуатации уязвимостей в камерных системах автономного слежения за целями. Атака сокращает дистанцию слежения до опасных уровней, позволяя захватывать дроны, атаковать сенсоры или вызывать физические столкновения.

Защита разделителями повышает устойчивость Gemma 4 к инъекциям промптов с 21% до 100% в тестовом бенчмарке из 6100+ примеров
Бенчмарк протестировал 15 моделей на 7 типах атак (6100+ тестов), используя случайные разделители вокруг ненадежного контента. Gemma 4 E4B улучшила показатель защиты с 21,6% до 100% при использовании разделителя + строгого промпта.

Инструмент "Плащ" заменяет пароли в чатах на самоуничтожающиеся ссылки для агентов OpenClaw.
Cloak — это инструмент с открытым исходным кодом, который заменяет пароли, передаваемые в чате агентам OpenClaw, на самоуничтожающиеся ссылки. Каждую ссылку можно открыть только один раз, после чего пароль исчезает, предотвращая накопление паролей в истории чатов.