ModelAgen 🇺🇸 11.08.2026 16:01

NVIDIA meluncurkan Nemotron 3.5 Lightning dan NeMo Switchyard untuk AI agen yang efisien

NVIDIANVIDIA OpenAIOpenAI AnthropicAnthropic
NVIDIA memperkenalkan Nemotron 3.5 Lightning, model mixture-of-experts dengan 30 miliar parameter yang dioptimalkan untuk tugas agen bervolume tinggi, memberikan output hingga 4x lebih cepat dan penyelesaian tugas 30% lebih cepat. Perusahaan ini juga merilis NeMo Switchyard, pustaka perutean model sumber terbuka untuk distribusi permintaan yang cerdas dalam alur kerja agen. Bersama-sama, keduanya menawarkan kontrol yang lebih besar atas penerapan dan efisiensi di berbagai lingkungan.
NVIDIA memperluas keluarga model Nemotron 3 dengan merilis Nemotron 3.5 Lightning, sebuah model mixture-of-experts dengan 30 miliar parameter yang dirancang untuk tugas-tugas khusus dalam sistem multi-agen yang lebih besar. Model ini memberikan kecepatan keluaran hingga 4 kali lebih cepat dan penyelesaian tugas agen 30% lebih cepat dibandingkan model lain di kelasnya. Model ini sepenuhnya dapat disesuaikan dan dapat dilatih ulang menggunakan NVIDIA NeMo dengan data domain, alat, dan alur kerja organisasi. Perusahaan juga merilis NeMo Switchyard, sebuah pustaka sumber terbuka untuk perutean model yang secara otomatis mengarahkan prompt ke model yang paling mampu dan efisien untuk setiap langkah alur kerja agen. Tolok ukur internal menunjukkan bahwa NeMo Switchyard mempertahankan akurasi tingkat frontier sambil mengurangi biaya penyelesaian tugas hingga hampir sepertiga dari biaya Opus 4.8 saja. Mitra termasuk CrowdStrike, Harvey, CodeRabbit, Lila Sciences, dan Fastino Labs sedang menyesuaikan Nemotron 3.5 Lightning untuk beban kerja mereka, sementara Boomi, Cadence, Cognition, Kong, LangChain, LiteLLM, Nous Research, Ramp, Siemens, dan Classmethod sedang mengintegrasikan atau mengevaluasi NeMo Switchyard.
Sumber: NVIDIA blog — asli
Postingan kami sebelumnya tentang topik ini ↓
Berita terbaru