Le NVIDIA Nemotron 3 Ultra domine le benchmark Deep Agents de LangChain avec une réduction décuplée du coût d'inférence
NVIDIA
LangChain
LangChain a configuré son framework Deep Agents pour le NVIDIA Nemotron 3 Ultra, obtenant la meilleure précision parmi les modèles ouverts et accomplissant plus de tâches avec un débit plus élevé pour un coût d'inférence 10 fois inférieur à celui des principaux modèles fermés. Cette performance n'a pas nécessité de réentraînement du modèle : toutes les améliorations ont été obtenues grâce à la configuration de l'environnement.
LangChain a optimisé son framework Deep Agents pour le NVIDIA Nemotron 3 Ultra, obtenant la plus haute précision parmi les modèles ouverts dans le benchmark LangChain Deep Agents, tout en accomplissant plus de tâches avec un débit plus élevé et un coût d'inférence 10 fois inférieur à celui des modèles fermés leaders. Le réglage n'a pas nécessité de réentraîner le modèle : toutes les améliorations ont été obtenues via la configuration de l'environnement d'ingénierie, y compris les invites système, les descriptions d'outils et le middleware. LangChain est une plateforme de développement d'agents avec plus de 200 millions de téléchargements par mois ; les développeurs peuvent désormais utiliser le profil Nemotron 3 Ultra optimisé pour construire des agents spécialisés. NVIDIA NemoClaw pour LangChain Deep Agents est une implémentation de référence ouverte qui combine le code Deep Agents optimisé pour Nemotron 3 Ultra avec l'environnement d'exécution sécurisé NVIDIA OpenShell. Des entreprises telles qu'Abridge, Amdocs et Box intègrent des agents spécialisés dans leurs plateformes, et l'intégrateur de systèmes mondial EY étend les capacités de déploiement NVIDIA en utilisant NemoClaw. L'accès à Nemotron 3 Ultra est fourni via des plateformes telles que Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius et Together AI.
Source: NVIDIA blog —
original
