모델 🇩🇪 05.08.2026 04:04

중국 오픈웨이트 AI: Kimi K3, 미국 프론티어 모델에 도전

Moonshot AIMoonshot AI OpenAIOpenAI AnthropicAnthropic MetaMeta MistralMistral DeepSeekDeepSeek
중국 스타트업 Moonshot AI가 2.8조 개의 파라미터를 가진 오픈웨이트 모델 Kimi K3를 출시하며 벤치마크에서 최고 성능을 주장했습니다. Artificial Analysis의 독립적인 테스트에서 Kimi K3는 Intelligence Index에서 Claude Fable 5와 GPT-5.6 Sol에 이어 3위를 차지했습니다. Kimi K3는 에이전트 및 자동화 작업에서 뛰어나며, 미국의 프론티어 모델에 상당한 도전이 되고 있습니다.
알리바바(Alibaba)의 지원을 받는 중국 스타트업 문샷 AI(Moonshot AI)가 2조 8000억 개의 파라미터를 가진 오픈 웨이트 모델 Kimi K3를 공개했다. 자체 벤치마크에 따르면 이 모델은 매우 우수한 성능을 보이며, 경쟁 모델인 Claude Fable 5와 GPT-5.6 Sol의 고급 버전 바로 다음 순위를 기록했다. 코딩 작업에서는 Kimi K3가 여섯 개 분야 중 두 개에서 1위를 차지했고, 나머지 모든 분야에서도 최소 3위 안에 들었다. 범용 에이전트로서의 성능은 더욱 뛰어나서 여섯 개 테스트 중 세 개에서 1위를 기록했지만, 전체적으로는 Fable 5가 앞섰다. 독립 평가 기관인 Artificial Analysis의 조사에서도 비슷한 결과가 나왔다. Kimi는 이들의 인텔리전스 지수(Intelligence Index)에서 57점을 기록하며 17위에서 3위로 도약했는데, 이는 Claude Fable 5보다 3점, GPT-5.6 Sol보다 2점 낮은 수치다. Kimi K3는 에이전트 및 자동화 작업에서 특히 우수한 성적을 보였으며, 자동화 부문에서는 Fable 5를 능가하기까지 했다. 환각(hallucination) 발생률은 이전 버전인 K2(51%)에 비해 크게 늘었지만, 이 지표에서는 Fable 5(55%)와 GPT-5.6 Sol(85%)이 더 나쁜 성적을 기록했다. 이는 2025년 1월 딥시크(DeepSeek)가 OpenAI, Google, Anthropic의 기존 멀티모달 AI에 근본적인 도전장을 던진 데 이어 나온 것으로, 미국의 반도체 수출 규제에도 불구하고 오픈소스 모델이 서구의 최첨단 모델들과 경쟁할 수 있음을 시사한다.
출처: Heise online — 원문
관련 게시물 ↓
새로운 뉴스