AIボットがTLS証明書ログをスキャン:LLMトレーニングに情報を利用
Human Security
OpenAI
Human Securityの「State of AI Traffic」レポートによると、AIボットのトラフィックが急増し、1年間で80倍に増加、2026年初頭には人間のトラフィックを超える見込みです。ボットはTLS証明書ログから従業員データまであらゆるものをスクレイピングし、オープンウェブを脅かし、サイトがコンテンツを閉鎖せざるを得なくなっています。
Human Securityの「State of AI Traffic」レポートは、AIボット活動の劇的な増加を明らかにした。AIエージェントのトラフィックは7,851%増加し、AIスクレイパーのトラフィックは597%増加、全体的なAIトラフィックは187%増加しており、人間のトラフィックの8倍の速さで成長している。2026年初頭までに、AIトラフィックは公式に人間のトラフィックを上回り、eコマースやメディアなどのコンテンツ豊富なサイトへの訪問のうち、ボットが占める割合は約90%に達した。偽アカウントは指数関数的に増加している。専門家はこれをオープンウェブの終焉と呼び、コンテンツがLLM(大規模言語モデル)のトレーニングのためにボットに即座に消費され、人間のトラフィックが急落している(例えば、テックメディアの訪問数は50%以上減少)と指摘する。パブリッシャーはコンテンツをペイウォールの背後に移動させ、Internet Archiveさえもブロックしている。ボットはまた、TLS証明書ログ(Certificate Transparencyログ)をスキャンして、クローリング用の新しいドメインを発見する。このレポートはHuman Defense Platformのデータに基づいている。CloudflareのCEOであるMatthew Princeはこの転換点が2027年に起こると予測していたが、実際には2026年に早まった。さらに、データブローカーは現在、企業内部のコミュニケーションアーカイブをLLMトレーニング用に販売しており、企業はチャットログ、メール、ビデオ録画を使用して従業員の「デジタルツイン」を作成し、従業員が退職した場合にスキルを再現している。
出典: Хабр — Data Mining —
原文
