Çin Açık Ağırlıklı Yapay Zekâ: Kimi K3, ABD Sınır Modellerine Meydan Okuyor
Moonshot AI
OpenAI
Anthropic
Meta
Mistral
DeepSeek
Çin merkezli girişim Moonshot AI, 2,8 trilyon parametreye sahip açık ağırlıklı model Kimi K3'ü yayınlayarak kıyaslamalarda en üst düzey performansı iddia ediyor. Artificial Analysis tarafından yapılan bağımsız testler, modeli Zekâ Endeksi'nde yalnızca Claude Fable 5 ve GPT-5.6 Sol'un arkasında üçüncü sıraya yerleştiriyor. Kimi K3; aracı tabanlı ve otomasyon görevlerinde öne çıkarak ABD sınır modelleri için önemli bir meydan okuma oluşturuyor.
Çinli startup Moonshot AI, Çinli internet ve ticaret grubu Alibaba tarafından desteklenen, 2,8 trilyon parametreye sahip Kimi K3 adlı açık ağırlıklı bir model yayınladı. Dahili kıyaslamalara göre, son derece iyi performans gösteriyor ve rakipleri Claude Fable 5 ile GPT-5.6 Sol'un üst düzey sürümlerinin hemen arkasında yer alıyor. Kodlama görevlerinde Kimi K3, altı disiplinden ikisini kazanıyor ve diğerlerinde en az üçüncü sırada yer alıyor. Evrensel bir ajan olarak daha da iyi performans gösteriyor, altı testten üçünü kazanıyor, Fable 5 ise genel olarak lider durumda. Laboratuvar Artificial Analysis tarafından yapılan bağımsız bir değerlendirme benzer sonuçlar buldu: Kimi, Zeka Endeksi'nde 57 puan alarak 17. sıradan 3. sıraya yükseldi ve Claude Fable 5'in sadece üç puan, GPT-5.6 Sol'un ise iki puan gerisinde kaldı. Kimi K3 özellikle ajan ve otomasyon görevlerinde iyi performans gösterdi, hatta otomasyonda Fable 5'i geride bıraktı. Halüsinasyon oranı K2 sürümüne (%51) kıyasla önemli ölçüde arttı, ancak Fable 5 (%55) ve GPT-5.6 Sol (%85) bu ölçütte daha kötü performans gösterdi. Bu durum, DeepSeek'in Ocak 2025'teki sürümünün ardından OpenAI, Google ve Anthropic'in yerleşik çok modlu yapay zekalarına yönelik bir başka temel meydan okuma olarak geliyor ve ABD çip ambargosuna rağmen açık kaynaklı modellerin batılı öncü modellerle rekabet edebileceğini gösteriyor.
Kaynak: Heise online —
orijinal
