DeepSeek ترقي إصدار V4-Flash-0731: مكاسب كبيرة في البرمجة الوكيلية ونسخة بيتا لواجهة البرمجة
DeepSeek
Anthropic
أطلقت DeepSeek إصدار DeepSeek-V4-Flash-0731، وهو ترقية رسمية لإصدارها التجريبي، مع تحسينات ملحوظة في معايير البرمجة الوكيلية والبرمجة. يحافظ النموذج على نفس البنية ولكنه يستفيد من إعادة التدريب، وأصبحت واجهة البرمجة الآن في نسخة بيتا العامة مع دعم تنسيق واجهة الاستجابات وتكيف Codex. الأوزان مرخصة بموجب MIT وغير مقيدة، مما يتيح خيارات نشر واسعة.
نشرت DeepSeek نموذج DeepSeek-V4-Flash-0731 على منصة Hugging Face ونقلت واجهة برمجة التطبيقات الرسمية لـ V4-Flash إلى الإصدار التجريبي العام في 31 يوليو 2026. تشير بطاقة النموذج إلى أن هذا هو الإصدار الرسمي الذي يحل محل الإصدار التجريبي، مع الحفاظ على البنية والحجم دون تغيير؛ وتأتي التحسينات من إعادة التدريب اللاحق. يتضمن نقطة التحقق وحدة فك الترميز التخمينية DSpark، وذكر Hugging Face أن عدد المعاملات يبلغ 304 مليار معلمة بما في ذلك وحدة المسودة بالإضافة إلى القاعدة البالغة 284 مليار معلمة. يدعم API الآن بشكل أصلي تنسيق واجهة برمجة تطبيقات الاستجابات وهو مُكيَّف لـ Codex، ولكن لم يتم تحديث API الخاص بـ V4-Pro أو نماذج التطبيق والويب. يمكن النشر عبر API بتكلفة منخفضة (حوالي ثلث سعر إخراج الإصدار الاحترافي) أو عبر الاستضافة الذاتية، الأمر الذي يتطلب موارد كبيرة: أوزان مرخصة بموجب MIT، لكن كل خبير يبقى في الذاكرة. يقدم مثال vLLM الخدمة على عقدة 4×GB300؛ وتناسب نماذج GGUFs الديناميكية من Unsloth حوالي 110 جيجابايت من الذاكرة مع تكميم قوي. تشمل البنية 284 مليار معلمة مع 13 مليارًا نشطة لكل رمز، وسياقًا بحجم مليون رمز، وانتباهًا هجينًا مع CSA وHCA، واتصالات فائقة مقيدة بالشعاع. تظهر المعايير أن V4-Flash-0731 يتفوق على V4-Pro (معاينة) في جميع معايير الوكلاء، لكن جميع الأرقام مبلغ عنها من قبل DeepSeek باستخدام أداة تقييم غير معلنة. يتم تمكين DSpark من خلال علامة vLLM، ويستخدم النموذج مجلد ترميز بدلاً من قالب محادثة Jinja.
المصدر: MarkTechPost —
الأصلي
