AI 안전모델 🇷🇺 07.08.2026 15:03

우려되는 추세: Moonshot의 Kimi K3 AI 모델도 '샌드박스'를 벗어나다

Moonshot AIMoonshot AI AnthropicAnthropic OpenAIOpenAI MetaMeta
테스트 중 중국 기업 Moonshot의 최신 AI 모델 Kimi K3가 지정된 환경을 벗어나는 데 성공했다고 연구자들이 밝혔다. 이 사건은 AI 개발자들이 자신이 만든 시스템을 얼마나 잘 통제할 수 있는지에 대한 의문을 다시 불러일으켰다. 영국 AI 안전 연구소(AISI)가 테스트를 실시했으며, 그 결과는 블룸버그에 의해 보도되었다.
문샷(Moonshot)의 Kimi K3 AI 모델이 영국 정부의 AI 안전 연구소(AISI)가 실시한 테스트 중에 테스트 '샌드박스'를 벗어났다고 블룸버그가 미국 연구 회사 프론티어 시큐리티(Frontier Security)의 정보를 인용해 보도했다. 다른 개발자들의 시스템과 달리, 이 중국 모델은 다른 회사들의 웹사이트를 해킹하려고 시도하지 않았지만, 테스트 결과 사이버 방어 수단이 부재한 것으로 나타났다. '공개적으로 제공되는 Kimi 모델에는 그러한 보호 메커니즘이 없습니다. 이는 해킹에 매우 적합하다는 것을 의미합니다.'라고 프론티어 시큐리티의 CEO인 야론 싱어(Yaron Singer)는 경고했다. 문샷과 AISI는 논평 요청에 응답하지 않았다. 이전에 앤트로픽(Anthropic), 오픈AI(OpenAI), 메타 플랫폼(Meta Platforms)도 자체 AI 모델이 테스트 환경을 벗어나 해킹한 사례를 보고한 바 있다. 이는 연구자와 정치인들을 놀라게 했으며, 더 엄격한 안전 점검과 더 안전한 테스트 환경을 요구하게 했다. 일부 사례에서 AI 모델은 허깅페이스(Hugging Face) 플랫폼을 포함한 제3자 리소스를 해킹했다. 무료로 제공되는 Kimi K3는 오픈AI와 앤트로픽의 선도 모델 수준의 성능을 보여주며 전 세계를 놀라게 했다. 이는 오랫동안 현지 경쟁사인 딥시크(DeepSeek)의 그늘에 가려 있던 중국 스타트업의 예상 밖의 돌파구였다. 문샷은 모델의 가중치를 공개하여 누구나 자유롭게 다운로드하고, 미세 조정하고, 자체 리소스에서 실행할 수 있게 했다.
출처: 3DNews — 원문
관련 게시물 ↓
새로운 뉴스