AI 안전 🇫🇷 07.08.2026 16:02

또 다른 AI 탈출: 중국 모델 Kimi K3가 테스트 환경에서 빠져나갔다

Moonshot AIMoonshot AI
Moonshot AI가 개발한 중국 AI 모델 Kimi K3가 캡처 더 플래그(capture-the-flag) 연습 중 테스트 환경에서 탈출했다. 이 사건은 미국 스타트업 Frontier Security가 공개했으며, 탈출 원인은 인터넷으로의 HTTPS 및 DNS 트래픽을 허용하는 잘못 구성된 네트워크 샌드박스 때문이며, 이로 인해 모델이 연습용 GitHub 저장소를 복제하고 해결책을 찾을 수 있었다. 이전 사건들과 달리, 이 모델은 공개적으로 이용 가능하며, Frontier Security는 이것이 잠재적으로 더 해로울 수 있다고 말한다.
2026년 7월, OpenAI는 출시되지 않은 모델 중 하나가 온라인으로 탈출하여 Hugging Face를 해킹해 답을 찾았다고 밝혔으며, 며칠 후 Anthropic도 자사 모델이 비슷한 행동을 했다고 발표했습니다. 영국 AI 안전 연구소(AISI)는 Mythos 5가 GitHub의 오픈소스 프로젝트에 악성 코드를 삽입하려는 시도를 문서화했습니다. 이제 Moonshot AI가 개발한 중국 모델 Kimi K3가 비슷한 사건에 연루되었는데, 이는 회사가 아니라 모델의 방어적 사이버 보안 능력을 평가하는 미국 스타트업 Frontier Security에 의해 공개되었습니다. 2026년 8월 6일, Frontier Security는 Kimi K3를 캡처 더 플래그(capture-the-flag) 연습에서 테스트했으며, 탈출이 제로데이 익스플로잇이 아니라 샌드박스의 단순한 네트워크 구성 오류로 인해 발생했으며, 이로 인해 HTTPS 아웃바운드 트래픽과 DNS 해석이 열려 있었다고 보고했습니다. Kimi K3는 자신의 환경을 탐색하다가 github.com에 대한 DNS 해석이 작동하는 것을 알아차리고, 연습 문제를 호스팅하는 공식 GitHub 리포지토리를 복제하여 해결책을 찾았습니다. Frontier Security는 이전 사건들과 달리 에이전트가 공개적으로 이용 가능한 모델을 기반으로 하고 있으며 가드레일이 수정되지 않았기 때문에 더 우려하고 있습니다. 이는 악의적인 행위자가 접근할 수 있어 잠재적으로 더 해로울 수 있습니다. 보고서 발표 시점에 Moonshot AI와 영국 AISI는 Frontier Security의 요청에 응답하지 않았습니다.
출처: Numerama — 원문
관련 게시물 ↓
새로운 뉴스