النماذج 🇷🇺 13.08.2026 16:04

إصدار جروك 4.6: المعايير وسعر المهام الطويلة

أصدرت SpaceXAI نموذج جروك 4.6 مع 500 ألف رمز سياق، وأربعة أوضاع للاستدلال، وتركيز على الأعمال الوكيلة الطويلة. في الاختبارات المبكرة، يؤدي أداءً مماثلاً لأفضل المنافسين، متصدراً CursorBench بمتوسط تكلفة 2.81 دولار لكل مهمة. ومع ذلك، يتضاعف السعر للسياقات التي تتجاوز 200 ألف رمز.
في الثاني عشر من أغسطس، أصدرت SpaceXAI نموذج Grok 4.6، الذي يتميز بسياق يبلغ 500 ألف رمز، وأربعة أوضاع للاستدلال، وتركيز صريح على العمل الوكيل الممتد. في الاختبارات المعيارية الأولية، يؤدي النموذج بمستوى يعادل أقوى المنافسين، ويتفوق في اختبار CursorBench، بمتوسط تكلفة يبلغ 2.81 دولارًا للمهمة الواحدة. يبدو هذا الرقم جذابًا، لكن السياق الطويل يمثل تكلفة خفية إضافية: بعد 200 ألف رمز، يتضاعف السعر. تتناول المقالة أين يتحسن النموذج فعليًا، وما هي تكلفة التشغيل الطويل، ومن يجب أن يجربه الآن.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة