Índice Web Agêntico: Estatísticas de Tráfego de Bots de IA Mostram Raspagem em Massa e Falsificação

Índice Web de Agentes: O Novo Painel de Tráfego de Bots de IA
A Known Agents publicou o Índice Web de Agentes, um painel que monitora a atividade de agentes de IA, rastreadores e scrapers em mais de 5.000 sites. Os dados vêm de suas ferramentas Agent Analytics e AI Chat Referral Tracking, e fornecem uma visão concreta do que está realmente atingindo seus servidores.
Métricas Principais: Bots São 35% de Todo o Tráfego
Nos últimos 90 dias, o índice relata:
- Tráfego de Bots vs. Humanos: 35% de todas as visitas são de bots — uma queda de 1% em relação aos 90 dias anteriores.
- Agenteificação: 29% do tráfego de bots é relacionado a IA — um aumento de 12%.
- Volume de Indicações de Chat de IA: 0,1% das visitas humanas vêm de chat de IA — uma queda de 7%.
- Eficácia do robots.txt: 98,5% dos bots seguem as regras do robots.txt.
Principais Tipos de Agentes e Visitantes
Ao detalhar o tráfego por tipo de agente, os rastreadores tradicionais de mecanismos de busca ainda dominam (22,8%), seguidos por rastreadores de SEO (19,5%) e rastreadores de busca de IA (12,5%). Scrapers de dados de IA como ClaudeBot e Amazonbot compõem 11%.
Os cinco principais visitantes:
bingbot— Rastreador de Mecanismo de Busca (8,2%)Googlebot— Rastreador de Mecanismo de Busca (7,8%)AhrefsBot— Rastreador de SEO (6,4%)Known Agent DEV— Auxiliar de Desenvolvimento (5,6%)ChatGPT-User— Assistente de IA (3,4%)
Outras entradas notáveis incluem ClaudeBot (Scraper de Dados de IA, 3,2%) e meta-externalagent (Scraper de Dados de IA, 2,3%).
Falsificação de Bots de IA para Varreduras em Massa de Vulnerabilidades
Além das estatísticas, o site destaca uma preocupação de segurança crescente: atacantes estão falsificando agentes de IA como o ClaudeBot para realizar varreduras em massa de vulnerabilidades. Ao disfarçar seu tráfego como um scraper de IA legítimo, eles podem sondar sites em busca de fraquezas enquanto passam despercebidos — muitos sites provavelmente não bloquearão um bot que acham estar apenas buscando páginas para treinamento de modelos.
Este é um lembrete prático: robots.txt é uma sugestão, não uma medida de segurança. Se você depende dele para manter scrapers afastados, você já está exposto. A taxa de conformidade de 98,5% se aplica apenas a bots honestos.
Para Quem é Isto
Se você administra um site, API ou qualquer serviço voltado ao público, estes dados ajudam a entender o que está realmente atingindo sua infraestrutura — e por que você precisa validar identidades de bots em vez de confiar em suas strings de user-agent.
📖 Leia a fonte completa: Agentes HN
👀 See Also

A Nvidia investe US$ 26 bilhões em modelos de IA de pesos abertos e lança o Nemotron 3 Super
A Nvidia investirá US$ 26 bilhões ao longo de cinco anos para construir modelos de IA de código aberto, de acordo com os registros financeiros de 2025. A empresa também lançou o Nemotron 3 Super, um modelo com 128 bilhões de parâmetros que supera o GPT-OSS em benchmarks e ocupa o primeiro lugar no PinchBench para controle do OpenClaw.

O libibverbs da Apple oculta símbolos GPUDirect RDMA; Buffer RDMA com cópia zero do Metal funciona no macOS
Um desenvolvedor descobriu que o subsistema RDMA da Apple aceita buffers de GPU Metal para transferências de rede com zero-cópia e encontrou símbolos ibv_reg_dmabuf_mr ocultos, sugerindo que GPUDirect RDMA é possível no macOS sem modificação do kernel.

A Anthropic Abandona Compromisso-Chave de Segurança de sua Política de Escalabilidade Responsável
A Anthropic removeu o compromisso central de sua Política de Escalonamento Responsável que exigia garantir medidas de segurança adequadas antes de treinar sistemas de IA, citando pressão competitiva e a necessidade de continuar o desenvolvimento.

Riscos de Litigação em Estruturas de Financiamento de Centros de Dados de IA
A expansão dos data centers de IA exigirá US$ 5,2 trilhões em investimentos em infraestrutura até 2030, com empresas utilizando estruturas de financiamento complexas como veículos de propósito específico (SPVs) e facilidades lastreadas em GPUs, o que gera nove categorias de risco de litígio.