NVIDIA、Nemotron 3.5 LightningとNeMo Switchyardを発表、効率的なエージェントAIを実現
NVIDIA
OpenAI
Anthropic
NVIDIAは、Nemotron 3.5 Lightningを発表しました。これは300億パラメータのMixture-of-Expertsモデルで、大量のエージェントタスク向けに最適化されており、最大4倍の出力速度と30%のタスク完了時間の短縮を実現します。また、同社はオープンソースのモデルルーティングライブラリであるNeMo Switchyardもリリースしました。これはエージェントワークフローにおけるインテリジェントなリクエスト分散を実現します。これらを組み合わせることで、さまざまな環境でのデプロイメントと効率のより高度な制御が可能になります。
NVIDIAは、Nemotron 3モデルファミリーを拡大し、大規模なマルチエージェントシステム内の専門タスク向けに設計された300億パラメータのMixture-of-Experts(混合エキスパート)モデルであるNemotron 3.5 Lightningをリリースしました。このモデルは、同クラスの他モデルと比較して、出力速度が最大4倍速く、エージェントタスクの完了が30%高速です。完全にカスタマイズ可能で、NVIDIA NeMoを使用して、組織のドメインデータ、ツール、ワークフローに基づいて追加学習(ポストトレーニング)を行うことができます。また、同社はモデルルーティング用のオープンソースライブラリであるNeMo Switchyardもリリースしました。これは、エージェントワークフローの各ステップに対して、最も能力が高く効率的なモデルにプロンプトを自動的に振り向けるものです。内部ベンチマークによると、NeMo Switchyardはフロンティアレベルの精度を維持しながら、タスク完了コストをOpus 4.8単独の場合のほぼ3分の1に削減します。CrowdStrike、Harvey、CodeRabbit、Lila Sciences、Fastino LabsなどのパートナーがNemotron 3.5 Lightningを自社のワークロードに合わせてカスタマイズしており、Boomi、Cadence、Cognition、Kong、LangChain、LiteLLM、Nous Research、Ramp、Siemens、ClassmethodなどがNeMo Switchyardを統合または評価しています。
出典: NVIDIA blog —
原文
