Bots de IA escaneiam logs de certificados TLS: informações usadas para treinar LLMs
Human Security
OpenAI
De acordo com o relatório State of AI Traffic da Human Security, o tráfego de bots de IA explodiu, aumentando 80 vezes em um ano e superando o tráfego humano até o início de 2026. Os bots extraem desde logs de certificados TLS até dados de funcionários, ameaçando a web aberta e forçando sites a fecharem seu conteúdo.
O relatório State of AI Traffic da Human Security revela um aumento drástico na atividade de bots de IA: o tráfego de agentes de IA aumentou 7.851%, o tráfego de scrapers de IA, 597%, e o tráfego geral de IA, 187% — crescendo oito vezes mais rápido que o tráfego humano. No início de 2026, o tráfego de IA ultrapassou oficialmente o tráfego humano, com bots representando quase 90% das visitas a sites ricos em conteúdo, como e-commerce e mídia. Contas falsas estão crescendo exponencialmente. Especialistas chamam isso de fim da web aberta, já que o conteúdo é instantaneamente consumido por bots para treinar LLMs (modelos de linguagem de grande porte), fazendo com que o tráfego humano despencasse (por exemplo, visitas a sites de tecnologia caíram mais de 50%). Editores estão colocando conteúdo atrás de paywalls e bloqueando até mesmo o Internet Archive. Bots também escaneiam logs de certificados TLS (logs de Transparência de Certificados) para descobrir novos domínios para rastreamento. O relatório é baseado em dados da Human Defense Platform. O CEO da Cloudflare, Matthew Prince, previu que esse ponto de virada ocorreria em 2027, mas aconteceu antes, em 2026. Além disso, corretores de dados agora vendem arquivos de comunicações internas de empresas para treinamento de LLMs, e empresas criam 'gêmeos digitais' de funcionários usando logs de chat, e-mails e gravações de vídeo para replicar habilidades caso um funcionário saia.
Fonte: Хабр — Data Mining —
original
