KI-Bots durchsuchen TLS-Zertifikatslogs: Werden diese Informationen zum Training von LLMs genutzt?
Human Security
OpenAI
Laut dem State of AI Traffic Report von Human Security ist der KI-Bot-Traffic explosionsartig gestiegen, hat sich in einem Jahr um das 80-fache erhöht und wird bis Anfang 2026 den menschlichen Traffic übertreffen. Bots scrapen alles von TLS-Zertifikatslogs bis hin zu Mitarbeiterdaten, bedrohen das offene Web und zwingen Websites, Inhalte zu schließen.
Der Bericht „State of AI Traffic“ von Human Security zeigt einen dramatischen Anstieg der Aktivität von KI-Bots: Der Verkehr durch KI-Agenten stieg um 7.851 Prozent, der durch KI-Scraper um 597 Prozent und der gesamte KI-Verkehr um 187 Prozent – und wuchs damit achtmal schneller als der menschliche Verkehr. Anfang 2026 überholte der KI-Verkehr offiziell den menschlichen Verkehr, wobei Bots fast 90 Prozent der Besuche auf inhaltsreichen Seiten wie E-Commerce und Medien ausmachten. Die Zahl der Fake-Accounts wächst exponentiell. Experten sprechen vom Ende des offenen Webs, da Inhalte sofort von Bots konsumiert werden, um große Sprachmodelle (Large Language Models, LLMs) zu trainieren, was zu einem Einbruch des menschlichen Verkehrs führt (zum Beispiel sanken die Besuche von Technologiemedien um über 50 Prozent). Verlage verlagern Inhalte hinter Bezahlschranken und blockieren sogar das Internet Archive. Bots durchsuchen außerdem TLS-Zertifikatsprotokolle (Certificate Transparency Logs), um neue Domains zum Crawlen zu entdecken. Der Bericht basiert auf Daten der Human Defense Platform. Der Cloudflare-CEO Matthew Prince hatte diesen Wendepunkt für 2027 vorhergesagt, doch er trat bereits Anfang 2026 ein. Darüber hinaus verkaufen Datenbroker mittlerweile Archive interner Unternehmenskommunikation zum Training von LLMs, und Unternehmen erstellen mithilfe von Chatprotokollen, E-Mails und Videoaufnahmen „digitale Zwillinge“ von Mitarbeitern, um deren Fähigkeiten im Falle eines Ausscheidens zu replizieren.
Quelle: Хабр — Data Mining —
Original
