⚡ 속보
Kimi K3: 2.8조 파라미터와 펠리컨 벤치마크에서 여전히 배울 수 있는 점
Moonshot AI
DeepSeek
Anthropic
OpenAI
Google/DeepMind
중국 AI 연구소 Moonshot AI가 2.8조 파라미터 모델 Kimi K3를 출시했습니다. 이 모델은 Claude Opus 4.8과 GPT-5.5를 능가하지만 Claude Fable 5 및 GPT-5.6 Sol에는 뒤처진다고 주장합니다. 모델은 웹사이트와 API를 통해 이용 가능하며, 2026년 7월 27일까지 오픈 웨이트가 공개될 예정입니다. Simon Willison은 그의 '자전거를 탄 펠리컨' SVG 벤치마크로 테스트했으며, 높은 비용과 많은 추론 토큰 사용량을 지적했습니다.
Moonshot AI가 자사의 최고 성능 모델인 Kimi K3를 발표했습니다. 2.8조 개의 파라미터를 가진 이 모델은 자사 웹사이트와 API를 통해 즉시 사용 가능하며, 오픈 웨이트(open-weight) 버전은 2026년 7월 27일에 출시될 예정입니다. Moonshot은 자체 보고된 벤치마크에서 Kimi K3가 Claude Opus 4.8과 GPT-5.5를 능가하지만, Claude Fable 5와 GPT-5.6 Sol에는 뒤처진다고 주장합니다. 가격은 입력 토큰 100만 개당 3달러, 출력 토큰 100만 개당 15달러로, 현재까지 중국산 AI 모델 중 가장 비쌉니다. Simon Willison은 OpenRouter를 통해 Kimi K3를 그의 펠리컨 SVG 벤치마크로 테스트했으며, 출력 비용으로 0.25달러를 지불했습니다. 이 모델은 95개의 입력 토큰과 16,658개의 출력 토큰(이 중 13,241개는 추론 토큰)을 사용했습니다. 생성된 SVG의 시각적 품질은 낮았지만, 대체 텍스트(alt text)는 훌륭했습니다. Willison은 펠리컨 벤치마크가 더 이상 전반적인 모델 품질을 예측하지는 못하지만, '헬로 월드(hello world)' 테스트, 비용 추정, 기본 기능 확인에는 여전히 유용하다고 지적합니다.
출처: Simon Willison —
원문
