ModelosAgentes 🇺🇸 11.08.2026 16:01

NVIDIA lança Nemotron 3.5 Lightning e NeMo Switchyard para IA agêntica eficiente

NVIDIANVIDIA OpenAIOpenAI AnthropicAnthropic
A NVIDIA apresentou o Nemotron 3.5 Lightning, um modelo de mistura de especialistas com 30 bilhões de parâmetros, otimizado para tarefas agênticas de alto volume, oferecendo até 4x mais rapidez na geração de saída e 30% mais rapidez na conclusão de tarefas. A empresa também lançou o NeMo Switchyard, uma biblioteca de roteamento de modelos de código aberto para distribuição inteligente de solicitações em fluxos de trabalho de agentes. Juntas, essas ferramentas oferecem maior controle sobre a implantação e a eficiência em diversos ambientes.
A NVIDIA está expandindo sua família de modelos Nemotron 3 com o lançamento do Nemotron 3.5 Lightning, um modelo de mistura de especialistas com 30 bilhões de parâmetros, projetado para tarefas especializadas em sistemas multiagentes maiores. O modelo oferece até 4x mais velocidade de saída e 30% mais rapidez na conclusão de tarefas agênticas em comparação a outros da sua classe. Ele é totalmente personalizável e pode ser pós-treinado com o NVIDIA NeMo nos dados, ferramentas e fluxos de trabalho de domínio de uma organização. A empresa também lançou o NeMo Switchyard, uma biblioteca de código aberto para roteamento de modelos que encaminha automaticamente prompts para o modelo mais capaz e eficiente em cada etapa de um fluxo de trabalho de agente. Benchmarks internos mostram que o NeMo Switchyard mantém precisão de nível avançado enquanto reduz o custo de conclusão de tarefas para quase um terço do Opus 4.8 sozinho. Parceiros como CrowdStrike, Harvey, CodeRabbit, Lila Sciences e Fastino Labs estão personalizando o Nemotron 3.5 Lightning para suas cargas de trabalho, enquanto Boomi, Cadence, Cognition, Kong, LangChain, LiteLLM, Nous Research, Ramp, Siemens e Classmethod estão integrando ou avaliando o NeMo Switchyard.
Fonte: NVIDIA blog — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas