NVIDIA lanza Nemotron 3.5 Lightning y NeMo Switchyard para una IA agéntica eficiente
NVIDIA
OpenAI
Anthropic
NVIDIA presentó Nemotron 3.5 Lightning, un modelo de 30 mil millones de parámetros con arquitectura de mezcla de expertos, optimizado para tareas agénticas de alto volumen, que ofrece hasta 4 veces más velocidad de salida y un 30% más de rapidez en la finalización de tareas. La compañía también lanzó NeMo Switchyard, una biblioteca de código abierto para el enrutamiento de modelos que permite una distribución inteligente de solicitudes en flujos de trabajo agénticos. Juntas, estas herramientas ofrecen un mayor control sobre el despliegue y la eficiencia en diversos entornos.
NVIDIA está ampliando su familia de modelos Nemotron 3 con el lanzamiento de Nemotron 3.5 Lightning, un modelo de mezcla de expertos de 30 mil millones de parámetros diseñado para tareas especializadas dentro de sistemas multiagente más grandes. El modelo ofrece una velocidad de salida hasta 4 veces más rápida y una finalización de tareas agénticas un 30% más rápida en comparación con otros de su clase. Es totalmente personalizable y se puede entrenar posteriormente con NVIDIA NeMo en los datos, herramientas y flujos de trabajo de una organización. La compañía también lanzó NeMo Switchyard, una biblioteca de código abierto para el enrutamiento de modelos que dirige automáticamente las indicaciones al modelo más capaz y eficiente para cada paso de un flujo de trabajo agéntico. Los puntos de referencia internos muestran que NeMo Switchyard mantiene una precisión de nivel frontera mientras reduce el costo de finalización de tareas a casi un tercio del costo de Opus 4.8 por sí solo. Socios como CrowdStrike, Harvey, CodeRabbit, Lila Sciences y Fastino Labs están personalizando Nemotron 3.5 Lightning para sus cargas de trabajo, mientras que Boomi, Cadence, Cognition, Kong, LangChain, LiteLLM, Nous Research, Ramp, Siemens y Classmethod están integrando o evaluando NeMo Switchyard.
Fuente: NVIDIA blog —
original
