نموذج نيموترون 3.5 لايتنينغ مفتوح المصدر من نفيديا يعطي الأولوية للسرعة على أقصى قدر من الذكاء
NVIDIA
OpenAI
Meta
Google/DeepMind
أصدرت نفيديا نموذج نيموترون 3.5 لايتنينغ، وهو نموذج مفتوح الأوزان وصغير الحجم يمتلك ربع عدد المعاملات ولكن بذكاء مماثل لنموذج جي بي تي-أو إس إس-120بي من أوبن إيه آي. ويُزعم أنه سريع للغاية، حيث يحقق ما يقارب 670 رمزًا في الثانية في الاختبارات الأولية بأوزان إن في إف بي 4 النهائية، وهو الأعلى بين النماذج المقارنة.
أطلقت شركة نفيديا نموذج Nemotron 3.5 Lightning، وهو أول نموذج في سلسلة Nemotron 3.5 الجديدة. وهو خليفة مباشر لنموذج Nemotron 3 Nano 30B A3B ويحتفظ بالبنية الهجينة Mamba-Transformer الخاصة بذلك النموذج: إجمالي 31.6 مليار معلمة، منها 3.6 مليار معلمة نشطة. وفقًا لمنصة المقارنات المستقلة Artificial Analysis، يحقق النموذج مؤشر ذكاء قدره 24، وهو قفزة بمقدار تسع نقاط عن سابقه (15). وهذا يضع Lightning على قدم المساواة مع نموذج gpt-oss-120b من OpenAI (24) وخلف نموذج Nemotron 3 Super من نفيديا مباشرةً (26)، وهو أكبر بحوالي أربع مرات. لا تزال النماذج الصغيرة الأكثر ذكاءً في نفس الفئة، مثل Qwen3.6 35B A3B (32) أو نموذج Muse Glimmer الجديد من Meta (35)، متقدمة بوضوح. تستهدف نفيديا من خلال Lightning نقطة مختلفة على حدود الكفاءة: في الاختبارات الأولية باستخدام الأوزان النهائية NVFP4، يصل النموذج إلى ما يقرب من 670 رمزًا في الثانية، وهو أعلى قيمة مُقاسة بين النماذج التي تمت مقارنتها، وأسرع بمرتين تقريبًا من نموذج Gemini 3.5 Flash-Lite من Google (386 رمزًا في الثانية). وبالتالي، تستغرق مهمة من مؤشر الذكاء حوالي 0.5 دقيقة، بينما يستغرق Qwen3.6 35B A3B حوالي 3.5 دقيقة وGemma 4 31B حوالي 5.8 دقيقة. تواصل النماذج المملوكة هيمنتها على حدود الكفاءة الإجمالية: يحقق Gemini 3.5 Flash-Lite مؤشر ذكاء قدره 37 بوقت مماثل لكل مهمة، بينما يصل GPT-5.6 Luna (الحد الأقصى) إلى 52 نقطة في أقل من دقيقتين. وفقًا لـ Artificial Analysis، تظهر أكبر التحسينات في القدرات الوكيلية. في اختبار GDPval-AA v2، يحقق Lightning درجة Elo تبلغ 824، بزيادة قدرها 334 نقطة عن Nemotron 3 Nano، متجاوزًا كلاً من gpt-oss-120b (800) ونموذج Nemotron 3 Super الأكبر (698). في اختبار Terminal-Bench v2.1، ترتفع النتيجة من 7 إلى 24.3 بالمائة، لتصل تقريبًا إلى مستوى gpt-oss-120b (26.2 بالمائة). من خلال الترخيص المسموح به OpenMDW-1.1، تضع نفيديا النموذج كأداة عمل فعالة لخطوط الأنابيب الوكيلية عالية الإنتاجية. وفقًا لـ Artificial Analysis، عملت نفيديا مع شركاء مثل CodeRabbit وHarvey على التدريب اللاحق لتحسين الأداء في مجالات محددة. توفر نفيديا النموذج بأوزان BF16 وNVFP4؛ كما يسجل إصدار NVFP4 أيضًا 24 على مؤشر الذكاء مع تدهور طفيف مقارنة بالإصدار عالي الدقة. يعالج نموذج الاستدلال النصوص فقط ويحتوي على نافذة سياق تبلغ مليون رمز. الأوزان متاحة فورًا؛ وتُقدم خدمة الاستدلال بدون خوادم من قبل DeepInfra وFireworks وFriendliAI وCoreWeave وGMI Cloud وNebius وCrusoe.
المصدر: The Decoder (DE) —
الأصلي
