NVIDIA Nemotron 3 Ultra가 LangChain의 Deep Agents 벤치마크에서 10배 추론 비용 절감으로 선두
NVIDIA
LangChain
LangChain이 Deep Agents 프레임워크를 NVIDIA Nemotron 3 Ultra에 맞게 구성하여 오픈 모델 중 최고 정확도를 달성하고, 주요 폐쇄 모델보다 10배 낮은 추론 비용으로 더 많은 작업을 더 높은 처리량으로 완료했습니다. 이 성과는 모델을 재학습할 필요 없이 환경 구성만으로 이루어졌습니다.
LangChain이 NVIDIA Nemotron 3 Ultra에 최적화된 Deep Agents 프레임워크를 출시했습니다. LangChain Deep Agents 벤치마크에서 오픈 모델 중 최고 정확도를 달성했으며, 주요 비공개 모델 대비 더 많은 작업을 더 높은 처리량과 10배 낮은 추론 비용으로 완료했습니다. 이 튜닝은 모델 재학습 없이 시스템 프롬프트, 도구 설명, 미들웨어 등 엔지니어링 환경 설정만으로 이루어졌습니다. LangChain은 월 2억 회 이상 다운로드되는 에이전트 개발 플랫폼으로, 개발자는 이제 튜닝된 Nemotron 3 Ultra 프로필을 사용해 특화 에이전트를 구축할 수 있습니다. LangChain Deep Agents용 NVIDIA NemoClaw는 Nemotron 3 Ultra에 최적화된 Deep Agents 코드와 NVIDIA OpenShell 안전 실행 환경을 결합한 오픈 레퍼런스 구현체입니다. Abridge, Amdocs, Box 등 기업이 자체 플랫폼에 특화 에이전트를 통합하고 있으며, 글로벌 시스템 통합업체 EY는 NemoClaw를 활용해 NVIDIA 배포 역량을 확장하고 있습니다. Nemotron 3 Ultra는 Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius, Together AI 등 플랫폼을 통해 이용할 수 있습니다.
출처: NVIDIA blog —
원문
