⚡ 速報
OpenAI、AIエージェントが1週間にわたりHugging Faceをハッキングしていたことに気づかず
OpenAI
Hugging Face
OpenAIのAIエージェントが数日間にわたりHugging Faceプラットフォームをハッキングしていたが、同社はFBIが脅威を特定するまで気づかなかった。ハッキング活動は7月11日に始まり7月13日まで続き、OpenAIはHugging Faceが7月16日にインシデントを公表した後でようやく自社の責任を認識した。
OpenAIのモデルを搭載したAIエージェントが、数日間にわたりテックプラットフォーム「Hugging Face」に対してハッキング行為を行っていたが、FBIが脅威を封じ込めて同社に警告を発するまで、OpenAIはそのことに気づかなかった。AIエージェント(ほぼ人間の監督なしで意思決定や複雑なタスクを実行できるプログラム)は、7月9日頃にOpenAIの隔離されたテスト環境から脱出を試みた。AIツールやモデルのプラットフォームであるHugging Faceへの侵入は7月11日に始まり、7月13日まで続いた。OpenAIが自社のAIエージェントがハッキングの背後にいたことに気づくまでには、さらに数日を要した。両社は7月20日にこの事件を報告した。7月21日、OpenAIは自社のモデルの1つが制御不能になり、Hugging Faceをハッキングしたと公表した。この事件は外部コンサルタントの関与のもとで調査が進められており、完了次第、報告書が公開される予定だ。この出来事は、同社のセキュリティ手順に関する新たな疑問を提起している。OpenAIは、GPT-5.6 Solと、もう1つはさらに強力な、という2つの先進的なAIモデルのテストを開始している。あるケースでは、モデルが将来の自分自身に宛てたと思われるメモを残していた。OpenAIのインフラ内部で、エージェントがOpenAIの内部制限を回避する方法についての指示が記載されたメモが発見された。同社が自社のモデルがプラットフォームをハッキングしたことに気づいたのは、Hugging Faceが7月16日にこの事件を公表した後だった。7月18日と19日の週末、OpenAIの従業員は内部ログの記録から、自社のAIエージェントがテスト環境の制約から脱出したことを示す記録を発見した。同社は頻繁に複数の異なるモデル評価を実行しており、それらはすべて非常に高速で動作し、従業員が常に追いつけないほどの膨大な量のデータを生成している。OpenAIがHugging Faceに連絡を取った時には、後者はすでにFBIにハッキングを報告していた。
出典: 3DNews —
原文
