模型智能体 🇺🇸 11.08.2026 16:01

英伟达推出 Nemotron 3.5 Lightning 和 NeMo Switchyard,助力高效智能体人工智能

NVIDIANVIDIA OpenAIOpenAI AnthropicAnthropic
英伟达推出了 Nemotron 3.5 Lightning,这是一款拥有 300 亿参数的专家混合模型,专为高容量智能体任务优化,输出速度提升高达 4 倍,任务完成速度快 30%。公司还发布了 NeMo Switchyard,这是一个开源的模型路由库,用于在智能体工作流中实现智能请求分发。这两者相结合,为不同环境下的部署和效率提供了更强的控制。
NVIDIA正在通过发布Nemotron 3.5 Lightning来扩展其Nemotron 3模型家族。这是一款300亿参数的混合专家模型,专为大型多代理系统中的特定任务而设计。与同类其他模型相比,该模型的输出速度最高提升4倍,代理任务完成速度提升30%。它完全可定制,并可使用NVIDIA NeMo针对组织的领域数据、工具和工作流程进行后训练。公司还发布了NeMo Switchyard,这是一个用于模型路由的开源库,可自动将提示词引导至代理工作流程中每个步骤能力最强、效率最高的模型。内部基准测试显示,NeMo Switchyard在保持前沿准确性的同时,将任务完成成本降低至仅使用Opus 4.8时的近三分之一。包括CrowdStrike、Harvey、CodeRabbit、Lila Sciences和Fastino Labs在内的合作伙伴正在为其工作负载定制Nemotron 3.5 Lightning,而Boomi、Cadence、Cognition、Kong、LangChain、LiteLLM、Nous Research、Ramp、Siemens和Classmethod等公司则正在集成或评估NeMo Switchyard。
来源: NVIDIA blog — 原文
我们之前关于此话题的帖子 ↓
最新新闻