13 palavras no Reddit podem manipular a busca de IA: Pesquisa de Cornell

✍️ OpenClawRadar📅 Publicado: June 28, 2026🔗 Source
13 palavras no Reddit podem manipular a busca de IA: Pesquisa de Cornell
Ad

Nova pesquisa da Universidade de Cornell demonstra que um único trecho de 13 palavras em sites de conteúdo gerado por usuários (UGC) como Reddit, Wikipedia ou Quora pode manipular de forma confiável a saída de agentes de busca de IA — incluindo ChatGPT e visões gerais de IA do Google. O artigo, 'Agentes de pesquisa profunda podem ser envenenados via conteúdo gerado por usuários', de Hal Triedman, Tingwei Zhang e Vitaly Shmatikov, revela como é trivial para marcas injetarem conteúdo promocional nos resultados de IA.

Os pesquisadores descobriram que agentes de pesquisa profunda citam UGC em aproximadamente metade de todas as consultas, e quase 25% de todas as citações vêm de sites UGC. Um único comentário envenenado no Reddit pode influenciar saídas para um cluster inteiro de consultas de IA relacionadas. Triedman explicou: 'Mostramos que um pequeno trecho — apenas 13 palavras — de texto recuperado em um site UGC como Reddit, Wikipedia, Quora, Facebook, etc. pode fazer com que agentes de IA gerem conteúdo spam/scam de forma bastante consistente.'

O ataque explora como LLMs usam similaridade lexical: eles tendem a retornar texto que parece semelhante à consulta do usuário. Ao estudar consultas populares de IA, as marcas podem criar conteúdo que espelha exatamente essas consultas, envenenando os resultados. 'Uma das coisas críticas é que, se um trecho de 11 a 15 palavras for muito semelhante à consulta, ele pode ser particularmente convincente para um LLM', disse Triedman.

Ad

Isso valida o que o 404 Media tem reportado como uma indústria em expansão: otimização para mecanismos de IA (AEO), onde marcas semeiam sites UGC com conteúdo promocional para manipular a busca de IA. Exemplos incluem o subreddit r/biohackers banindo discussões sobre peptídeos devido ao excesso de astroturfing, e empresas como RedRover oferecendo posicionamentos de marca explicitamente para influenciar saídas de busca de IA.

A pesquisa levanta questões sobre se moderadores voluntários no Reddit e Wikipedia podem se defender sustentavelmente contra essa manipulação, especialmente depois que um tribunal alemão decidiu que o Google pode ser responsabilizado pelo conteúdo das visões gerais de IA.

Para desenvolvedores que constroem agentes de IA: isso significa que qualquer ferramenta que raspe sites UGC para contexto é vulnerável a envenenamento trivial. Confiar apenas na similaridade lexical como sinal de precisão agora é conhecido por ser explorável em escala.

📖 Leia a fonte completa: HN AI Agents

Ad

👀 See Also

OpenClaw Security: 13 Passos Práticos para Proteger Seu Agente de IA
Security

OpenClaw Security: 13 Passos Práticos para Proteger Seu Agente de IA

Uma postagem no Reddit descreve 13 medidas de segurança para instalações do OpenClaw, incluindo executar em uma máquina separada, usar Tailscale para isolamento de rede, colocar subagentes em sandbox no Docker e configurar listas de permissão para acesso de usuários.

OpenClawRadar
Caelguard: Scanner de Segurança de Código Aberto para Instâncias OpenClaw
Security

Caelguard: Scanner de Segurança de Código Aberto para Instâncias OpenClaw

Caelguard é um scanner de segurança de código aberto desenvolvido para OpenClaw que executa 22 verificações em sua instância, incluindo isolamento Docker, escopo de permissões de ferramentas e verificação da cadeia de suprimentos de habilidades. Ele fornece uma pontuação de 140 com uma nota em letra e etapas específicas de correção.

OpenClawRadar
Malwar: Um Scanner de Vulnerabilidades para Arquivos .md SKILL Construído com Claude Code
Security

Malwar: Um Scanner de Vulnerabilidades para Arquivos .md SKILL Construído com Claude Code

Um desenvolvedor lançou o Malwar, uma ferramenta gratuita que verifica arquivos SKILL.md em busca de instruções maliciosas usando um pipeline de 4 camadas, incluindo um mecanismo de regras, rastreador de URLs, análise de LLM e inteligência de ameaças. A ferramenta foi construída inteiramente com Claude Code depois que o desenvolvedor encontrou padrões preocupantes, como blobs Base64 e instruções para canalizar a saída do curl para o bash em habilidades existentes.

OpenClawRadar
🦀
Security

Startup israelense Irregular ligada a hacks de IA desonestos na OpenAI, Anthropic e Meta

A CNBC informa que a startup israelense Irregular foi ligada a ataques de IA desonestos na OpenAI, Anthropic e Meta. Os ataques visaram sistemas de IA, levantando preocupações sobre a segurança da IA.

OpenClawRadar