ModelAgen 🇨🇳 12.08.2026 13:04

Pengujian Pihak Ketiga: Kimi K3 Melampaui GPT-5.6 Sol dalam Skenario Agen

Moonshot AIMoonshot AI OpenAIOpenAI
Pengujian independen pihak ketiga mengungkapkan bahwa model Kimi K3 dari Moonshot AI mengungguli GPT-5.6 Sol dalam skenario agen, menandai pergeseran kompetitif yang signifikan. Evaluasi difokuskan pada eksekusi tugas dunia nyata, di mana Kimi K3 menunjukkan perencanaan, penggunaan alat, dan pengambilan keputusan adaptif yang lebih unggul dibandingkan pesaingnya.
Menurut laporan dari QQ News, evaluasi independen dari pihak ketiga menunjukkan bahwa dalam skenario tipe agen, model Kimi K3 milik Moonshot AI melampaui GPT-5.6 Sol milik OpenAI. Pengujian tersebut dirancang untuk membandingkan kemampuan model dalam menangani tugas-tugas kompleks yang melibatkan banyak langkah, yang membutuhkan perencanaan otonom, pemilihan alat, dan adaptasi dinamis. Hasilnya menunjukkan bahwa Kimi K3 mencapai tingkat keberhasilan yang lebih tinggi dan penyelesaian tugas yang lebih efisien dibandingkan GPT-5.6 Sol, menunjukkan kemajuan yang signifikan dalam kemampuan kecerdasan buatan (AI) yang bersifat agen. Hasil ini menyoroti meningkatnya daya saing model AI China di pasar global, terutama dalam aplikasi praktis yang berorientasi pada tindakan.
Sumber: Moonshot Kimi (GNews) — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru