NVIDIA Nemotron 3 Ultra dẫn đầu chuẩn Deep Agents của LangChain với chi phí suy luận giảm mười lần
NVIDIA
LangChain
LangChain đã cấu hình khung Deep Agents của mình cho NVIDIA Nemotron 3 Ultra, đạt được độ chính xác tốt nhất trong số các mô hình mở và hoàn thành nhiều tác vụ hơn với thông lượng cao hơn với chi phí suy luận thấp hơn 10 lần so với các mô hình đóng hàng đầu. Thành tựu này không yêu cầu huấn luyện lại mô hình: tất cả cải tiến đều đạt được thông qua cấu hình môi trường.
LangChain đã tối ưu hóa framework Deep Agents của mình cho NVIDIA Nemotron 3 Ultra, đạt độ chính xác cao nhất trong số các mô hình mở trong benchmark Deep Agents của LangChain, đồng thời hoàn thành nhiều tác vụ hơn với thông lượng cao hơn và chi phí suy luận thấp hơn 10 lần so với các mô hình đóng hàng đầu. Việc tinh chỉnh không yêu cầu huấn luyện lại mô hình: tất cả cải tiến đều đạt được thông qua cấu hình môi trường kỹ thuật, bao gồm prompt hệ thống, mô tả công cụ và phần mềm trung gian. LangChain là nền tảng phát triển agent với hơn 200 triệu lượt tải xuống mỗi tháng; các nhà phát triển hiện có thể sử dụng hồ sơ Nemotron 3 Ultra đã được tinh chỉnh để xây dựng các agent chuyên biệt. NVIDIA NemoClaw cho LangChain Deep Agents là một triển khai tham chiếu mã nguồn mở kết hợp mã Deep Agents được tối ưu hóa cho Nemotron 3 Ultra với môi trường thực thi an toàn NVIDIA OpenShell. Các công ty như Abridge, Amdocs và Box đang tích hợp các agent chuyên biệt vào nền tảng của họ, và nhà tích hợp hệ thống toàn cầu EY đang mở rộng khả năng triển khai NVIDIA bằng NemoClaw. Quyền truy cập Nemotron 3 Ultra được cung cấp thông qua các nền tảng như Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius và Together AI.
Nguồn: NVIDIA blog —
bản gốc
