النماذجالأعمال والسوق 🇷🇺 14.08.2026 09:03

إصدار Grok 4.6: كيف وصل النموذج إلى مستوى GPT-5.6 بنصف التكلفة

AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI
أصدرت SpaceXAI نموذج Grok 4.6، والذي وفقًا للشركة يطابق مستوى أقوى النماذج في السوق بنصف التكلفة: 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. يسجل النموذج 61 على مؤشر الذكاء الخاص بـ Artificial Analysis، مما يعادل GPT-5.6 Sol، وأصبح متاحًا بالفعل في Grok Build وCursor وGrok Bot وعبر واجهة برمجة التطبيقات.
أعلنت شركة SpaceXAI عن إطلاق نموذج Grok 4.6، مدعية أنه يصل إلى مستوى أقوى النماذج بنصف تكلفة المنافسين: بسعر 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. النموذج متاح بالفعل في وكيل Grok Build، وفي Cursor، وفي Grok Bot، وعبر واجهة برمجة التطبيقات، مع مضاعفة حدود الاستخدام للأسبوع الأول في Cursor وGrok Build. الرقم الرئيسي هو 61 نقطة على مؤشر الذكاء لمنصة التحليلات المستقلة Artificial Analysis، الذي يجمع تسعة معايير تقييم. وهذا يطابق GPT-5.6 Sol في وضع التفكير الأقصى، ويكون أقل بنقطة واحدة من Claude Fable 5 Max، وأعلى بـ5 نقاط من Grok 4.5 الصادر قبل شهر. يقول المحللون إن SpaceXAI عادت إلى حدود الذكاء، ولا تتقدمها سوى Anthropic. على المعايير التفصيلية، يتصدر Grok 4.6 في GDPVal-AA v2 للأعمال المكتبية المعرفية بـ1753 نقطة مقابل 1741 لـFable 5 و1728 لـSol، وفي AA-Briefcase بـ1577 مقابل 1574 و1502. كما يتصدر في معيار Harvey LAB القانوني بنسبة 15.8% مقارنة بـ11.3% لـFable 5 و2.5% لـSol. ومع ذلك، يتخلف بشكل ملحوظ في Terminal-Bench v3.0: 26% مقابل 34.6% لـSol و34.1% لـFable 5، لكن في الإصدار الأقدم v2.1 يحقق 88.4%، وهو ثاني أفضل بعد Claude Opus 5. كما يخسر في بعض معايير البرمجة: في DeepSWE يتخلف عن Sol (73%) وFable 5 (70%)، وفي FrontierCode وAPEX-SWE يخسر أمام Fable 5. الجانب الأكثر إثارة للاهتمام هو كيفية تحقيق التكافؤ: وفقًا لماسك، تم بناء Grok 4.6 على نفس قاعدة المعلمات البالغة 1.5 تريليون مثل Grok 4.5، لذلك لم ينمو النموذج. بدلاً من التوسع، أجرت الشركة دورة تدريبية أخرى أطول على نفس القاعدة مع بيانات اصطناعية منسقة حول موضوعات التفكير والهندسة ومحسّن محسّن، ثم أعادت بناء مرحلتي الضبط الدقيق المشرف والتعلم المعزز. تم إعادة إنشاء مسارات الضبط الدقيق المشرف بواسطة Grok 4.5 نفسه، مع تصفية الأمثلة الإشكالية بفحوصات نموذجية—وبالتالي، درّب الإصدار السابق الإصدار التالي. في Cursor، المملوك الآن لـSpaceXAI، لاحظوا أن Grok 4.6 يبني بنية التطبيق ولغته البصرية من المحاولة الأولى بناءً على وصف الفكرة، وفي المسارات الطويلة يُظهر فحصًا ذاتيًا أكبر بشكل ملحوظ: فهو يختبر عمله قبل المتابعة. تراوحت مهام التعلم المعزز أثناء التدريب من تحسين النوى الحسابية إلى تطوير الويب والتصميم بمساعدة الحاسوب. الاقتصاد لا يزال كما هو من Grok 4.5، الذي صدر في 8 يوليو: نفس $2/$6، والذي وفقًا لـArtificial Analysis أقل بأكثر من 60% من Claude Opus 5 ($5/$25) وGPT-5.6 Sol ($5/$30). تبلغ تكلفة مهمة مؤشر الذكاء 0.84 دولارًا للنموذج، مثل Kimi K3، ولكن مع ذكاء أعلى قليلاً، مما يضعه بالضبط على حدود باريتو للذكاء مقابل السعر. كفاءته المميزة في عدد الرموز مستمرة: في AA-Briefcase، يكمل Grok 4.6 مهمة وكيل طويلة في متوسط 53 جولة ونصف مليار رمز إدخال، مقابل 103 جولات وملياري رمز لـClaude Opus 5. فقط زيادات الإدخال المؤقت ارتفعت، من $0.3 إلى $0.5 لكل مليون. لدى SpaceXAI وتيرة إصدار قوية: ظهر Grok 4.5 لأول مرة في 8 يوليو، وGrok 4.6 في 12 أغسطس، وGrok 4.7 بمعلمات تبلغ 2.1 تريليون، وقدّر ماسك في مكالمة أغسطس أنه على بعد ثلاثة إلى أربعة أسابيع، أي بحلول أواخر الصيف. إلى جانب شراء Cursor ووكيل Grok Bot الذي تم إطلاقه سابقًا، يتحول Grok من ميم إلى خط إنتاج ببيئة تطوير خاصة به ووكيل وخط أنابيب نماذج.
المصدر: Habr — хаб ML — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة