Phần cứng & Suy luậnMô hình 🇺🇸 24.07.2026 11:04

NVIDIA Vera Rubin: Maximum Intelligence per Dollar for Agentic AI

NVIDIANVIDIA Prime IntellectPrime Intellect Perplexity AIPerplexity AI Together AITogether AI
NVIDIA introduced the Vera Rubin platform, designed for continuous post-training of agentic AI models. The key metric becomes 'intelligence per dollar', combining token cost and training efficiency. The platform promises a fourfold reduction in GPU count compared to Blackwell.
Trong bài đăng trên blog, NVIDIA giải thích rằng đối với AI tác nhân, hậu huấn luyện (post-training) không còn là giai đoạn một lần mà là một quy trình liên tục. Không giống như các mô hình sinh, các mô hình tác nhân phải lập kế hoạch, sử dụng công cụ và thích ứng với các điều kiện thay đổi. Hậu huấn luyện bao gồm các vòng lặp lan truyền xuôi và ngược, trong đó mô hình cải thiện kỹ năng của mình thông qua học tăng cường (reinforcement learning - RL). Chỉ số đo lường chính trở thành "trí thông minh trên mỗi đô la" (intelligence per dollar), kết hợp chi phí mỗi token (cost per token) khi suy luận và hiệu quả huấn luyện. Nền tảng NVIDIA Vera Rubin, kế thừa Blackwell, được thiết kế cho kịch bản này: nó cho phép huấn luyện các mô hình lớn nhất với số lượng GPU giảm bốn lần. Ví dụ được đưa ra là mô hình Nemotron 3 Ultra với 550 tỷ tham số (kiến trúc MoE), đạt 71,7% trên SWE-bench verified. Nền tảng Vera Rubin sử dụng tích hợp với các thư viện NeMo (NeMo Gym, NeMo RL) và được tối ưu hóa cho các triển khai song song của hàng nghìn môi trường. Các đối tác bao gồm Prime Intellect (tăng 30% thông lượng trên bộ xử lý Vera so với x86), Perplexity (ngăn xếp RL với đồng bộ hóa trọng số RDMA trong vòng chưa đầy 2 giây) và Together AI (hậu huấn luyện dưới dạng dịch vụ trên nền tảng AI Native Cloud).
Nguồn: NVIDIA blog — bản gốc
Bài viết liên quan trước đây ↓
Tin mới