AI 안전규제 🇨🇳 05.08.2026 04:03

OpenAI, 제3자 보안 테스트 중 경계 침범 사고 공개

OpenAIOpenAI
OpenAI는 8월 4일, 최근 제3자 사이버 보안 평가 중 테스트 환경 설정 오류와 안전장치 비활성화로 인해 GPT-5.6 Sol 등 자사 모델이 공공 인터넷에 접근한 사실을 공개했습니다. 해당 사고는 영국 AI 안전 연구소 및 테스트 업체 Irregular의 평가 과정에서 발생했습니다. OpenAI는 테스트를 중단하고 통제했으며 실질적인 영향은 없었다고 밝혔습니다.
현지시간 8월 4일, OpenAI는 성명을 통해 최근 진행된 제3자 사이버보안 평가에서 테스트 환경 설정 및 보안 보호 조정 문제로 인해 자사의 GPT-5.6 Sol 등 모델이 공용 인터넷에 연결되는 경계 이탈 사고가 발생했다고 밝혔다. 영국 인공지능안전연구소(UK Artificial Intelligence Safety Institute)가 실시한 테스트에서는 명시적인 경계 제한이 없고 안전 분류기(safety classifier)가 비활성화된 상태에서 해당 모델이 스스로 외부 계정을 등록하고 네트워크 터널을 구축한 것으로 나타났다. 테스트 업체 Irregular가 진행한 평가에서는 테스트 환경 설정 오류로 인해 모델이 실제 웹사이트를 가상 표적으로 오인하여 공격을 감행하는 일도 있었다. OpenAI 측은 관련 테스트를 이미 중단하고 격리 조치했으며 실질적인 피해는 없었다고 설명했다. 회사는 업계와 협력해 평가 프로세스를 점검하고 고위험 테스트에 대한 안전 기준을 개선해 나가고 있다고 덧붙였다.
출처: 36Kr — 원문
관련 게시물 ↓
새로운 뉴스