إصدار Grok 4.6: تعزيز الذكاء الاصطناعي الوكيل، وتحسين المعايير، متوفر في Cursor وGrok Build
xAI
أصدرت xAI إصدار Grok 4.6، وهو نسخة مطورة من نموذج الذكاء الاصطناعي الخاص بها تركز على الوكلاء طويلي التشغيل والمهام التفاعلية والبصرية المعقدة. يُظهر النموذج أداءً تنافسيًا في عدة معايير، حيث يطابق أو يتفوق أحيانًا على GPT-5.6 Sol وFable 5. Grok 4.6 متوفر في Cursor وGrok Build، مع إمكانية الوصول عبر واجهة برمجة التطبيقات والمنصات الشريكة.
أعلنت xAI عن إطلاق نموذج Grok 4.6، الذي يبني على نموذج Grok 4.5 مع قدرات محسّنة للمهام الوكيلة طويلة المدى، وتحسين التعامل مع العمليات المعقدة متعددة الخطوات بما في ذلك البحث والبرمجة وتحويل الأفكار إلى تطبيقات متكاملة. تم تدريب النموذج باستخدام مرحلة ممتدة من التدريب الإضافي مع بيانات منتقاة بعناية تم إنشاؤها بواسطة النموذج، ومحسّن محسّن، ومنهجية محدّثة، تليها مراحل الضبط الدقيق المشرف (SFT) والتعلم التعزيزي (RL). يُظهر النموذج قدرات في الفحص الذاتي والتحقق، ويتميز في تحويل أفكار المنتجات إلى نماذج أولية عاملة، خاصة في المشاريع البصرية والتفاعلية. تم ترقية آليات السلامة ومعايرتها، حيث خضع النموذج لأكثر الاختبارات شمولاً في تاريخ xAI. تُظهر نتائج المعايير أن Grok 4.6 High يحقق مؤشر الذكاء الاصطناعي (AA Intelligence Index) 61، وGDPVal-AA الإصدار 2 1753، وCursorBench الإصدار 3.2 بنسبة 69.9%، وDeepSWE الإصدار 1.1 بنسبة 65.9%، وFrontierCode الإصدار 1.1 (ممتد) بنسبة 61.3%، وAPEX-Agents بنسبة 57.5%، وTerminal-Bench الإصدار 3.0 بنسبة 26%، وAPEX-SWE بنسبة 56.4%، وAA-Briefcase 1577، وHarvey LAB (Vals) بنسبة 15.8%. يتوفر Grok 4.6 الآن في Cursor وGrok Build، وكذلك عبر واجهة برمجة التطبيقات (API) وعلى المنصات الشريكة بما في ذلك OpenRouter وVercel وCloudflare. يبدأ السعر من 2 دولار لكل مليون رمز إدخال و6 دولار لكل مليون رمز إخراج، مع نسخة أسرع بتكلفة مضاعفة. خلال الأسبوع الأول، يتم مضاعفة الاستخدام المضمّن في Grok Build وCursor.
المصدر: Habr — хаб ИИ —
الأصلي
