Índice Web de Agentes: Las Estadísticas de Tráfico de Bots de IA Muestran Raspado Masivo y Suplantación

Índice Web de Agentes: El Nuevo Panel de Tráfico de Bots de IA
Known Agents ha publicado el Índice Web de Agentes, un panel que rastrea la actividad de agentes de IA, rastreadores y scrapers en más de 5,000 sitios web. Los datos provienen de su Agent Analytics y AI Chat Referral Tracking, y ofrecen una visión concreta de lo que realmente está impactando tus servidores.
Métricas Clave: Los Bots Son el 35% de Todo el Tráfico
En los últimos 90 días, el índice reporta:
- Tráfico de Bots vs. Humanos: El 35% de todas las visitas son de bots, un 1% menos que en los 90 días anteriores.
- Agentificación: El 29% del tráfico de bots está relacionado con IA, un 12% más.
- Volumen de Referencias de Chat de IA: El 0.1% de las visitas humanas provienen de chat de IA, un 7% menos.
- Efectividad de robots.txt: El 98.5% de los bots siguen las reglas de robots.txt.
Principales Tipos de Agentes y Visitantes
Al desglosar el tráfico por tipo de agente, los rastreadores de motores de búsqueda tradicionales aún dominan (22.8%), seguidos por los rastreadores SEO (19.5%) y los rastreadores de búsqueda de IA (12.5%). Los scrapers de datos de IA como ClaudeBot y Amazonbot representan el 11%.
Los cinco principales visitantes:
bingbot— Rastreador de Motor de Búsqueda (8.2%)Googlebot— Rastreador de Motor de Búsqueda (7.8%)AhrefsBot— Rastreador SEO (6.4%)Known Agent DEV— Ayudante de Desarrollador (5.6%)ChatGPT-User— Asistente de IA (3.4%)
Otras entradas notables incluyen ClaudeBot (Scraper de Datos de IA, 3.2%) y meta-externalagent (Scraper de Datos de IA, 2.3%).
Suplantación de Bots de IA para Escaneos Masivos de Vulnerabilidades
Más allá de las estadísticas, el sitio destaca una creciente preocupación de seguridad: los atacantes están suplantando a agentes de IA como ClaudeBot para ejecutar escaneos masivos de vulnerabilidades. Al disfrazar su tráfico como un scraper de IA legítimo, pueden sondear sitios web en busca de debilidades mientras pasan desapercibidos: muchos sitios es poco probable que bloqueen a un bot que creen que solo está obteniendo páginas para entrenar modelos.
Este es un recordatorio práctico: robots.txt es una sugerencia, no una medida de seguridad. Si dependes de él para mantener fuera a los scrapers, ya estás expuesto. La tasa de cumplimiento del 98.5% solo se aplica a bots honestos.
Para Quién Es Esto
Si ejecutas un sitio web, una API o cualquier servicio público, estos datos te ayudan a entender qué está impactando realmente tu infraestructura y por qué necesitas validar las identidades de los bots en lugar de confiar en sus cadenas de user-agent.
📖 Lee la fuente completa: HN AI Agents
👀 Ver también

Mujer de Tennessee Encarcelada por Seis Meses Debido a Error de Reconocimiento Facial con IA
Angela Lipps, una abuela de 50 años de Tennessee, pasó casi seis meses en la cárcel después de que la policía de Fargo utilizara un software de reconocimiento facial para identificarla incorrectamente como sospechosa en un caso de fraude bancario en Dakota del Norte. Fue liberada en Nochebuena después de que los registros bancarios demostraron que estaba a 1,200 millas de distancia en el momento de los delitos.

El Operador de IA: Un Nuevo Rol para Flujos de Trabajo Agénticos
Rish Gupta argumenta que los operadores de IA serán el rol clave en las organizaciones dentro de un año, combinando habilidades técnicas (Python, APIs de LLM, frameworks de agentes) con comprensión de procesos de negocio para automatizar tareas repetitivas y de alto impacto.

Claude-Code v2.1.33: Mejorando la Automatización con Precisión
La última versión de Claude-Code v2.1.33 introduce características clave que revolucionan aún más a los agentes de codificación de IA, aumentando tanto la eficiencia como la precisión.

Evaluación de LLMs locales: generación de backend mediante llamada a funciones – comparativa entre GLM, Qwen y DeepSeek
Un riguroso benchmark de LLMs locales y fronterizos para generación de código backend mediante llamadas a funciones, con rúbrica de puntuación. Hallazgos clave: qwen3.5-35b-a3b iguala a gpt-5.4 en diseño DB/API, y el denso Qwen 27B supera al MoE de 397B. Los modelos fronterizos se eliminaron por costo.