에이전틱 웹 인덱스: AI 봇 트래픽 통계가 대규모 스크래핑과 스푸핑을 보여준다

에이전틱 웹 인덱스: 새로운 AI 봇 트래픽 대시보드
Known Agents가 에이전틱 웹 인덱스를 발표했습니다. 이 대시보드는 5,000개 이상의 웹사이트에서 AI 에이전트, 크롤러, 스크래퍼 활동을 추적합니다. 데이터는 자사의 에이전트 분석 및 AI 채팅 추천 추적에서 비롯되었으며, 실제로 서버에 무엇이 도달하는지 구체적으로 보여줍니다.
주요 지표: 봇이 전체 트래픽의 35%
지난 90일 동안 인덱스는 다음을 보고합니다:
- 봇 vs. 인간 트래픽: 전체 방문의 35%가 봇에서 발생 — 이전 90일 대비 1% 감소.
- 에이전트화: 봇 트래픽의 29%가 AI 관련 — 12% 증가.
- AI 채팅 추천 볼륨: 인간 방문의 0.1%가 AI 채팅에서 발생 — 7% 감소.
- robots.txt 효과: 봇의 98.5%가 robots.txt 규칙을 따릅니다.
주요 에이전트 유형 및 방문자
에이전트 유형별로 트래픽을 분류하면 전통적인 검색 엔진 크롤러가 여전히 우세하며(22.8%), 그 다음으로 SEO 크롤러(19.5%)와 AI 검색 크롤러(12.5%)가 뒤를 잇습니다. ClaudeBot 및 Amazonbot과 같은 AI 데이터 스크래퍼는 11%를 차지합니다.
상위 5개 방문자:
bingbot— 검색 엔진 크롤러 (8.2%)Googlebot— 검색 엔진 크롤러 (7.8%)AhrefsBot— SEO 크롤러 (6.4%)Known Agent DEV— 개발자 도우미 (5.6%)ChatGPT-User— AI 어시스턴트 (3.4%)
기타 주목할 만한 항목으로는 ClaudeBot (AI 데이터 스크래퍼, 3.2%) 및 meta-externalagent (AI 데이터 스크래퍼, 2.3%)가 있습니다.
AI 봇을 사칭한 대규모 취약점 스캔
통계 외에도 사이트는 증가하는 보안 우려를 강조합니다: 공격자들이 ClaudeBot과 같은 AI 에이전트를 사칭하여 대규모 취약점 스캔을 수행합니다. 그들의 트래픽을 합법적인 AI 스크래퍼로 위장함으로써, 그들은 탐지를 피하면서 웹사이트의 약점을 조사할 수 있습니다 — 많은 사이트가 모델 훈련을 위해 페이지를 가져오는 봇이라고 생각하고 차단하지 않을 가능성이 높습니다.
이것은 실용적인 알림입니다: robots.txt는 제안이지 보안 조치가 아닙니다. 스크래퍼를 차단하기 위해 그것에 의존한다면, 이미 노출된 것입니다. 98.5%의 준수율은 정직한 봇에게만 적용됩니다.
누구를 위한 것인가
웹사이트, API 또는 공개 서비스를 운영한다면, 이 데이터는 인프라에 실제로 무엇이 도달하는지, 그리고 사용자 에이전트 문자열을 신뢰하는 대신 봇 신원을 검증해야 하는 이유를 이해하는 데 도움이 됩니다.
📖 전체 소스 읽기: HN AI Agents
👀 See Also

대법원, 검토 거부... AI 생성 예술은 저작권 인정 불가
미국 대법원은 AI 생성 예술의 저작권에 관한 사건을 심리하지 않기로 결정하여, 저작권 보호를 위해 '인간 저작자'를 요구하는 하급 법원 판결을 그대로 유지했습니다. 이는 2022년 저작권청이 스티븐 테일러가 그의 알고리즘으로 만든 이미지에 대한 저작권 요청을 거부한 데 이은 것입니다.

아마존 직원들, 슬랙에서 회사 AI 조롱하며 '슬로펜하이머'라 칭해
아마존 직원들은 회사의 결함 있는 AI 코딩 제품을 조롱하는 밈을 위한 슬랙 채널을 운영하며, 그 출력물을 '슬롭'이라고 부르고 실패한 AI 동기부여 노력을 농담 삼아 비판하고 있습니다.

실리콘밸리 개발자들, 클로드 AI 집중 사용 패턴과 인프라 부담 보고
메타의 한 시니어 AI 엔지니어가 Claude Code 토큰에 월 2,000달러를 지출하고, 2개 이상의 에이전트를 동시에 실행하며, Claude 대화에서 Obsidian 지식 그래프를 자동 생성하는 VS Code 확장 프로그램을 구축했습니다. 리뷰 없이 Claude가 생성한 코드를 배포한 결과 인프라가 '완전히 망가졌다'고 보고됩니다.
2026년에도 코드를 작성해야 하는 이유: AI 에이전트에게 인간의 코딩은 여전히 중요하다
Doug Turnbull은 강력한 AI 코딩 에이전트가 있더라도 인간이 아키텍처를 이해하고, 취약성을 줄이며, 에이전트를 효과적으로 안내하기 위해 직접 코드를 작성해야 한다고 주장합니다.