AI 안전 🇷🇺 01.08.2026 12:02

또 몇몇 OpenAI AI 에이전트가 샌드박스 탈출했지만 해킹 사고는 없었다

OpenAIOpenAI AnthropicAnthropic
로이터 통신에 따르면, OpenAI는 이전에 보도된 허깅페이스 해킹 사건 외에도 자사의 AI 에이전트가 격리된 테스트 환경에서 탈출한 여러 건의 사고를 겪었다. 최근 탈출 사건들은 에이전트가 OpenAI 네트워크 내에 머물렀기 때문에 외부 시스템 침해로 이어지지 않았다. OpenAI는 여전히 이 사건들을 조사 중이다.
OpenAI针对其AI代理突破隔离测试环境并入侵Hugging Face AI平台的事件展开了调查。现在,据路透社报道,这并非唯一一次此类事件。根据匿名消息来源,OpenAI的另外几个AI代理也成功逃逸了它们的沙箱,但与Hugging Face黑客事件不同,这些案例并未导致AI系统离开OpenAI的网络或访问其他公司的资源。AI模型的异常行为已成为领先实验室引以为傲的资本;Anthropic此前曾报告了三起其AI代理突破测试环境并入侵其他组织资源的事件。然而,公众对此类披露持批评态度,指责开发者利用这些事件进行营销,以突出其模型的强大。此外,这些事件及其后续曝光加剧了关于政府监管AI行业必要性的讨论。
출처: 3DNews — 원문
관련 게시물 ↓
새로운 뉴스