النماذج 🇺🇸 27.07.2026 02:02

Kimi K3: 2.8 تريليون معلمة ونظرة جديدة على معيار 'البجع'

Moonshot AIMoonshot AI DeepSeekDeepSeek AnthropicAnthropic OpenAIOpenAI Google/DeepMindGoogle/DeepMind
أصدرت شركة Moonshot AI الصينية نموذج Kimi K3 الذي يحتوي على 2.8 تريليون معلمة، واصفة إياه بأنه أول نموذج "مفتوح من فئة 3 تريليونات". يتفوق K3 على Claude Opus 4.8 max وGPT-5.5 high، لكنه يتخلف عن Claude Fable 5 وGPT-5.6 Sol، بتكلفة 3 دولارات لكل مليون رمز إدخال و15 دولارًا لكل مليون رمز إخراج، مما يجعله الأغلى بين النماذج الصينية. يلاحظ المؤلف أيضًا أن معيار 'البجع' يفقد ارتباطه بجودة النموذج ولكنه يظل مفيدًا للتقييم السريع. النموذج متاح بالفعل عبر الموقع الإلكتروني وواجهة البرمجة، مع وعد بإصدار الأوزان المفتوحة بحلول 27 يوليو.
أعلنت مختبرات Moonshot AI الصينية عن نموذج Kimi K3، الذي تصفه بأنه "الأقوى حتى الآن"، بعدد 2.8 تريليون معلمة. وتضعه الشركة كأول نموذج "مفتوح من فئة 3T" (بتقريب 2.8 إلى 3 تريليونات)، متجاوزةً DeepSeek ونموذجها 1.6T v4 Pro. وفقاً لمعاييرها الخاصة، يتفوق K3 بشكل عام على Claude Opus 4.8 max وGPT-5.5 high، لكنه يخسر أمام Claude Fable 5 وGPT-5.6 Sol. ووفقاً لتقرير Artificial Analysis، في تقييمهم الخاص لـ"المعرفة طويلة المدى"، سجل K3 درجة Elo 1547، وهي أعلى بـ732 نقطة من Kimi K2.6، ولا يتفوق عليها سوى Claude Fable 5. تبلغ تكلفة المهمة (0.94 دولار) مقاربةً لـGPT-5.6 Sol (1.04 دولار)، ونحو نصف سعر Opus 4.8 (1.80 دولار)، لكنها أعلى من النماذج المفتوحة المماثلة. انخفض استخدام التوكنات في K3 بنسبة 21% مقارنةً بـK2.6. يتصدر النموذج أيضاً ساحة تدوين الواجهات الأمامية (Frontend Code) من Arena.ai، متجاوزاً حتى Claude Fable 5. أسعار واجهة برمجة التطبيقات (API): 3 دولارات لكل مليون توكن إدخال و15 دولاراً لكل مليون توكن إخراج، وهي مماثلة لسلسلة Claude Sonnet من Anthropic، مما يجعل K3 أغلى نموذج بين مختبرات الذكاء الاصطناعي الصينية. هذه زيادة كبيرة مقارنة بـKimi K2.6 (0.95 دولار / 4 دولارات). عدد المعلمات 2.8 تريليون، أي أكثر من ضعف النموذج السابق البالغ 1 تريليون معلمة. اختبر المؤلف K3 عبر OpenRouter، حيث أنشأ SVG لبجعة على دراجة. تطلب الطلب 95 توكن إدخال و16,658 توكن إخراج (منها 13,241 توكن استدلال)، بتكلفة 25 سنتاً. عند معالجة ملف SVG المُنشَأ مرة أخرى، وصف النموذج الصورة بدقة (بتكلفة 0.6 سنت). يلاحظ المؤلف أن اختبار "البجعة" على مدار 21 شهراً فقد علاقته بالجودة العامة للنموذج، حيث تأتي أفضل النتائج حالياً من GLM-5.2، رغم أنه لا يرقى لفئة Fable. ومع ذلك، يظل الاختبار مفيداً كـ"مرحباً بالعالم": فهو يدفع لتجربة النموذج، ويقدم تقديراً تقريبياً للتكلفة ووقت الاستدلال، ويتحقق من الفهم الأساسي للهندسة والقدرة على إنشاء SVG صحيح. بالنسبة لـK3، كشف الاختبار أن النموذج يستخدم حالياً مستوى واحداً فقط من جهد الاستدلال ("max")، ويستهلك العديد من توكنات الاستدلال، كما أشار إلى وجود تعليمات نظامية خفية محتملة (85 توكن). الوصف البصري من النموذج عالي الجودة.
المصدر: Simon Willison — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة