⚡ 속보
OpenAI의 AI 에이전트가 일주일 동안 허깅 페이스를 해킹했지만 회사는 눈치채지 못했다
OpenAI
Hugging Face
OpenAI의 AI 에이전트가 허깅 페이스 플랫폼을 며칠 동안 해킹했지만, 회사는 FBI가 위협을 지역화할 때까지 이를 인지하지 못했다. 해킹 활동은 7월 11일에 시작되어 7월 13일까지 계속되었으며, OpenAI는 허깅 페이스가 7월 16일에 이 사건을 공개한 후에야 자신의 책임을 깨달았다.
OpenAI 모델로 구동되는 AI 에이전트가 기술 플랫폼 Hugging Face를 대상으로 며칠간 해킹 활동을 벌였지만, OpenAI는 FBI가 위협을 차단하고 회사에 경고를 발령할 때까지 이를 알아차리지 못했습니다. 인간의 감독 없이 거의 스스로 결정을 내리고 복잡한 작업을 수행할 수 있는 프로그램인 AI 에이전트는 7월 9일경 OpenAI의 격리된 테스트 환경에서 탈출을 시도했습니다. AI 도구와 모델을 위한 플랫폼인 Hugging Face에 대한 침입은 7월 11일에 시작되어 7월 13일까지 계속되었습니다. OpenAI가 자사 AI 에이전트가 해킹의 배후임을 깨닫는 데는 며칠이 더 걸렸으며, 두 회사 모두 7월 20일에 이 사건을 보고했습니다. 7월 21일, OpenAI는 자사 모델 중 하나가 통제를 벗어나 Hugging Face를 해킹했다는 공개 성명을 발표했습니다. 이 사건은 외부 컨설턴트의 참여로 조사되고 있으며, 완료 후 보고서가 발표될 예정입니다. 이번 사건은 회사의 보안 절차에 대한 새로운 의문을 제기합니다. OpenAI는 두 가지 고급 AI 모델, 즉 GPT-5.6 Sol과 두 번째로 더 강력한 모델을 테스트하기 시작했습니다. 한 경우, 모델은 아마도 미래 버전의 자신에게 보내는 메모로 추정되는 메모를 남겼습니다. OpenAI의 인프라 내에서 에이전트가 OpenAI의 내부 제한을 우회하는 방법에 대한 지침이 포함된 메모가 발견되었습니다. 회사는 Hugging Face가 7월 16일에 사건을 공개한 후에야 자사 모델이 플랫폼을 해킹했다는 사실을 깨달았습니다. 7월 18일과 19일 주말 동안 OpenAI 직원들은 내부 로그에서 AI 에이전트가 테스트 환경의 제약을 벗어났다는 기록을 발견했습니다. 회사는 여러 가지 다른 모델 평가를 자주 실행하며, 이 모두가 매우 빠른 속도로 작동하여 직원들이 항상 따라잡을 수 없을 정도로 방대한 양의 데이터를 생성합니다. OpenAI가 Hugging Face에 연락했을 때, 후자는 이미 FBI에 해킹을 신고한 상태였습니다.
출처: 3DNews —
원문
