Gentoo Bugzilla wegen Überlastung durch KI-Bot-Scraper vom Netz genommen

Gentoo-Maintainer Michał Górny hat #Gentoo Bugzilla offline genommen, mit der Begründung, dass KI-Bot-Scraper den Server überlastet hätten. Er gab die Ankündigung auf Mastodon ab und wies auf das wachsende Problem automatischer Scraper-Bots hin, die die Infrastruktur belasten. So viel zum Thema "Demokratisierung des Zugangs" zu Issue-Trackern.
Was passiert ist
Der Beitrag ist kurz und knapp: "Ich habe #Gentoo Bugzilla offline genommen, weil es …" – vermutlich "von KI-Bot-Traffic überwältigt wurde" oder ähnlich. Keine sanfte Degradierung, kein CAPTCHA-Unsinn. Einfach offline genommen, um die Blutung zu stoppen.
Das ist kein Einzelfall. Im vergangenen Jahr haben Open-Source-Projekte von Spitzen im automatisierten Traffic durch KI-Trainings-Scraper berichtet, oft mit
Was Entwickler tun sollten
Wenn Sie für Gentoo auf Bugzilla angewiesen sind, müssen Sie die Gentoo-Website auf Updates prüfen. In der Zwischenzeit hier ein praktischer Kontext:
- Seien Sie geduldig – Dies ist wahrscheinlich eine vorübergehende Maßnahme, bis das Projekt geeignete Rate-Limiting- oder Blocklisten-Regeln hinzufügen kann.
- Nutzen Sie alternative Kanäle – Gentoo-Mailingslisten und GitHub-Mirrors verfolgen oft Issues, wenn auch nicht mit dem vollständigen Bugzilla-Funktionsumfang.
- Scrapen Sie nicht aggressiv – Wenn Sie KI-Tools bauen, die öffentliche Issue-Tracker indizieren, respektieren Sie
robots.txtund setzen Sie angemessene Ratenlimits. DerUser-agent, den Sie senden, ist wichtig.
Das Infrastruktur-Team des Gentoo-Projekts wird wahrscheinlich Maßnahmen wie IP-basiertes Throttling, Cloudflare-Challenges oder strengere robots.txt-Regeln einsetzen, sobald der Dienst wiederhergestellt ist. Der Shutdown unterstreicht vorerst ein systemisches Problem: KI-Agenten, die auf öffentlichen Daten trainiert werden, werden zu einer nicht nachhaltig aggressiven Traffic-Quelle für von Freiwilligen betriebene Projekte.
Wenn Sie ein öffentlich zugängliches Tool betreiben, erwägen Sie, Ratenlimits für Endpunkte mit niedriger Priorität einzuführen und den Datenverkehr zu überwachen.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

KI-Kohlenhydratzählen scheitert an Reproduzierbarkeit: 27.000 Anfragen ergeben 429g Abweichung bei einem Foto
Eine Studie mit 26.904 KI-Abfragen in 4 Modellen ergab, dass Gemini 2.5 Pro seine Kohlenhydratschätzungen für ein einzelnes Paella-Foto von 55 g bis 484 g variierte – ein potenzieller Insulinausschlag von 42,9 IE. Claude zeigte nur eine mediane Variation von 2,4 %.

Talkie: Ein 13B LLM, ausschließlich mit Texten vor 1931 trainiert, unter Verwendung von Claude als Bewerter im RL-Training
Forscher haben Talkie veröffentlicht, ein 13B-LLM, das ausschließlich auf Texten aus der Zeit vor 1931 trainiert wurde (kein Internet, keine Daten zum Zweiten Weltkrieg). Claude Sonnet 4.6 wurde als Richter in der Online-DPO-verstärkungslern-Pipeline verwendet, und Claude Opus 4.4 generierte synthetische Multi-Turn-Gespräche für das Feintuning. Das Modell kann aus wenigen kontextuellen Beispielen Python-Code schreiben, obwohl im Training keinerlei moderner Code vorhanden war.

Entwickler ersetzt 25-Dollar-pro-Stunde-Virtual-Assistant durch KI-Agenten, stellt sich ethischen Implikationen
Ein Entwickler ersetzte eine virtuelle Assistentin für 25 US-Dollar pro Stunde durch KI-Agenten, die Nachverfolgungen, Terminplanung, Lead-Tracking und CRM-Aktualisierungen übernehmen. Das KI-Setup kostet etwa 1.000 US-Dollar pro Monat und erledigt Aufgaben schneller und konsistenter als die menschliche Assistentin.
Claude Fable 5.1 und Mythos 5.1: Dasselbe Modell, unterschiedliche Schutzmaßnahmen
Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht – dasselbe Modell, aber mit unterschiedlichen Sicherheitsstufen. Fable 5.1 ist 25% günstiger, mit bis zu 45% Ersparnis bei agentischen Arbeitslasten, und erkennt nun Schwachstellen.