NVIDIA تطلق Nemotron 3.5 Lightning للمهام الوكيلة المتخصصة السريعة
NVIDIA
وسعت NVIDIA عائلتها من نماذج Nemotron 3 بإطلاق Nemotron 3.5 Lightning، وهو نموذج مفتوح يعتمد على خليط الخبراء بحجم 30 مليار معلمة، مصمم للوكلاء دائمي التشغيل، ويوفر تسريعًا يصل إلى 4 أضعاف في توليد الرموز و30% أسرع في وقت الإنجاز مقارنة بالنماذج المفتوحة في فئته. يمكن ضبط النموذج بدقة للمهام الشخصية ويعمل محليًا على منصات NVIDIA المختلفة. كما قدمت NVIDIA مكتبة NeMo Switchyard مفتوحة المصدر للتوجيه، والتي تحسّن سير عمل الوكلاء من حيث الدقة والسرعة والتكلفة، ويُذكر أنها تخفض تكاليف إنجاز المعايير إلى نحو ثلث تكلفة استخدام Opus 4.8 وحده.
أعلنت NVIDIA عن نموذج Nemotron 3.5 Lightning، وهو نموذج مفتوح قابل للتخصيص من نوع mixture-of-experts (MoE) بحجم 30B، مصمم للوكلاء دائمي التشغيل، مما يوسع عائلة Nemotron 3. يوفر النموذج سرعة توليد رموز أسرع حتى 4 مرات، وسرعة إنجاز أسرع بنسبة 30% مقارنة بالنماذج المفتوحة في فئته. نظرًا لأن أوزانه مفتوحة، يمكن للمطورين ضبطه بدقة لأساليب أو تخصصات أو اصطلاحات برمجية محددة، مما يتيح تجارب ذكاء اصطناعي وكيلية شخصية محلية مثل إدارة البريد الإلكتروني، أو روتينات المنزل الذكي، أو رفيق برمجة. تعاونت NVIDIA مع vLLM وOllama وllama.cpp وLM Studio وUnsloth لتوفير خيارات نشر محلية محسّنة، بما في ذلك صيغ NVFP4 وGGUF. يعمل النموذج محليًا على أجهزة تتراوح من أجهزة NVIDIA RTX PC وDGX Spark إلى Jetson، ويتوسع ليشمل محطات العمل ومراكز البيانات مع أنظمة Blackwell من شركاء مثل Acer وASUS وDell وLenovo. بالإضافة إلى ذلك، قدمت NVIDIA مكتبة NeMo Switchyard، وهي مكتبة توجيه مفتوحة المصدر توجه كل خطوة من خطوات سير عمل الوكيل إلى النموذج الأنسب بناءً على الدقة والسرعة والتكلفة، مما يساعد المؤسسات على إدارة تكاليف الرموز. تُظهر المعايير الداخلية أن NeMo Switchyard خفضت تكاليف إنجاز المعايير إلى حوالي ثلث تكاليف Opus 4.8 مع الحفاظ على إنجاز المهام بمستوى متقدم. تتوفر NeMo Switchyard على GitHub.
المصدر: NVIDIA blog —
الأصلي
