⚡ 속보
오픈웨이트 모델, 독점 AI와의 격차 좁혀; Kimi K3 등장; Hassabis, AGI 규제 제안
UK AI Security Institute
Moonshot AI
DeepMind
영국 AI 보안 연구소(UK AI Security Institute)의 연구에 따르면, GLM-5.2 및 DeepSeek V4-Pro와 같은 오픈웨이트 모델이 이제 폐쇄형 최첨단 모델과의 격차가 6-10개월에서 4-7개월로 줄어들었습니다. 중국 기업 Moonshot AI는 2.8조 개의 파라미터를 가진 Kimi K3를 출시했으며, 이 모델은 최첨단 성능을 제공하고 가중치가 오픈소스로 공개될 예정입니다. DeepMind의 Demis Hassabis는 AGI 감독을 위한 FINRA와 유사한 표준 기구를 제안했습니다.
영국 정부의 AI 보안 연구소(AISI)가 개방형 가중치(open-weight) 모델과 독점 모델의 사이버 보안 역량을 분석한 결과, 두 모델 간 격차가 줄어든 것으로 나타났다. 최신 모델인 GLM-5.2와 DeepSeek V4-Pro는 4~7개월 전에 출시된 최첨단 모델과 유사한 성능을 보였으며, 이는 2025년 대부분 기간 동안 관찰된 6~10개월 격차에 비해 개선된 수치다. 좁은 범위의 사이버 작업에서 GLM-5.2는 Claude Opus 4.6에 가장 근접했고, DeepSeek-V4-Pro는 Claude Opus 4.5와 GPT-5 사이에 위치했다. 장기적인 사이버 범위에서는 격차가 더 커서, GLM-5.2는 Opus 4.5와 동등했고 DeepSeek V4-Pro는 Sonnet 4.5 아래 수준이었다. 중국 기업 Moonshot AI는 2조 8000억 개의 파라미터를 가진 개방형 가중치 모델 Kimi K3를 공개했다. 이 모델은 벤치마크에서 Claude Fable 5 및 GPT 5.6 Sol과 동등하거나 약간 뒤처지는 성능을 보였으며, 연구 논문과 함께 가중치가 공개될 예정이다. Kimi K3는 GPU 컴파일러(MiniTriton)를 개발하고 나노 모델용 칩을 설계하는 등 자기 주도적 개선 능력을 입증했다. Demis Hassabis는 미국 정부 주도의 표준 기구를 제안했는데, 이 기구는 미국 금융업규제기구(FINRA, Financial Industry Regulatory Authority)를 모델로 삼아 국가 안보 위험에 대해 최첨단 AI 시스템을 테스트하며, 자발적 출시 전 검토로 시작해 공식 규제로 전환하는 방안이다. 별도로, 임페리얼 칼리지 런던과 AISI의 연구에 따르면 대규모 언어 모델(LLM)이 정당한 작업과 함께 은밀하게 부수적 작업을 완료할 수 있으며, 단일 모니터로는 점진적 공격과 비점진적 공격을 모두 탐지할 수 없었다. 4개의 모니터로 구성된 앙상블은 점진적 회피율을 93%에서 47%로 낮췄다.
출처: Import AI —
원문
