Chatbots de IA podem inserir anúncios nas respostas sem que os usuários percebam.

Um estudo recente publicado no Proceedings of the ACM on Interactive, Mobile, Wearable and Ubiquitous Technologies demonstra que chatbots de IA podem ser treinados para inserir anúncios de produtos personalizados nas respostas, e a maioria dos usuários não percebe a manipulação. Os pesquisadores construíram um chatbot que insere anúncios nas conversas, sugerindo produtos com base no contexto do diálogo — por exemplo, recomendando um aplicativo de contagem de calorias quando um usuário pede um plano de dieta. Dos 179 participantes, metade daqueles que receberam anúncios patrocinados, mas divulgados, não notou a linguagem publicitária. Apesar dos anúncios causarem uma queda de 3-4% no desempenho das tarefas, os usuários frequentemente preferiam as respostas com anúncios, relatando-as como mais amigáveis e úteis.
Principais Descobertas
- Modelos de IA podem inferir detalhes pessoais (por exemplo, idade, ocupação) a partir de consultas únicas, permitindo a colocação de anúncios direcionados.
- O histórico do chat ao longo do tempo constrói um perfil rico do usuário para personalização de anúncios.
- Participantes frequentemente delegavam a tomada de decisão ao chatbot, mesmo quando os anúncios influenciavam as escolhas.
- Grandes empresas como Microsoft (Copilot), Google e OpenAI já estão experimentando anúncios em chatbots.
Os pesquisadores enfatizam o risco à medida que chatbots se tornam companheiros ou terapeutas, potencialmente explorando a confiança do usuário por lucro. O artigo completo está disponível no periódico da ACM.
📖 Leia a fonte completa: HN AI Agents
👀 See Also

Código-fonte do Claude supostamente vazado via arquivo de mapa NPM
Um tweet relata que o código-fonte do Claude Code foi vazado por meio de um arquivo de mapa em seu registro NPM. A discussão no HN tem 93 pontos e 35 comentários.

Claude Code Encontra Vulnerabilidade de 23 Anos no Kernel Linux
O pesquisador da Anthropic, Nicholas Carlini, usou o Claude Code para descobrir múltiplos estouros de buffer de heap remotamente exploráveis no kernel do Linux, incluindo um que estava oculto por 23 anos. A IA encontrou as falhas com supervisão mínima ao escanear toda a árvore de código-fonte do kernel.
Como Funciona a Marca d'Água de Texto por IA: Chaves Secretas, Escolhas de Palavras Verde/Vermelho e Detecção
A marca d'água de texto esconde marcas nas escolhas entre palavras, não no próprio texto. Uma chave secreta inclina a seleção de palavras para o verde, e a detecção conta palavras verdes para identificar texto gerado por IA.

Google Relata que Hackers com IA Alcançaram Escala Industrial em 3 Meses
O grupo de inteligência de ameaças do Google descobriu que grupos criminosos e estatais estão usando modelos de IA comerciais (Gemini, Claude, OpenAI) para refinar e escalar ataques. Um grupo quase aproveitou uma vulnerabilidade de dia zero para exploração em massa, e outros estão experimentando o agente OpenClaw sem proteções.