Hardware & InferentieModellen 🇺🇸 24.07.2026 11:04

NVIDIA Vera Rubin: Maximale Intelligentie per Dollar voor Agentische AI

NVIDIANVIDIA Prime IntellectPrime Intellect Perplexity AIPerplexity AI Together AITogether AI
NVIDIA introduceerde het Vera Rubin-platform, ontworpen voor continue nabewerking van agentische AI-modellen. De belangrijkste meeteenheid wordt 'intelligentie per dollar', een combinatie van tokencost en trainingsefficiëntie. Het platform belooft een viervoudige vermindering van het aantal GPU's in vergelijking met Blackwell.
NVIDIA в блоге объясняет, что для агентного ИИ пост-тренинг (post-training) — больше не разовый этап, а непрерывный процесс. В отличие от генеративных моделей, агентные модели должны планировать, использовать инструменты и адаптироваться к меняющимся условиям. Пост-тренинг включает циклы прямого и обратного проходов, где модель через обучение с подкреплением (RL) улучшает свои навыки. Ключевой метрикой становится «интеллект за доллар» (intelligence per dollar), который объединяет стоимость токена (cost per token) при инференсе и эффективность обучения. Платформа NVIDIA Vera Rubin, наследница Blackwell, спроектирована для этого сценария: она позволяет обучать крупнейшие модели с вчетверо меньшим числом GPU. В качестве примера приводится модель Nemotron 3 Ultra с 550 млрд параметров (архитектура MoE), показавшая 71,7% на SWE-bench verified. Платформа Vera Rubin использует интеграцию с библиотеками NeMo (NeMo Gym, NeMo RL) и оптимизирована для параллельных развёртываний тысяч сред. Партнёры — Prime Intellect (30% прироста пропускной способности на процессорах Vera по сравнению с x86), Perplexity (RL-стек с RDMA-синхронизацией весов менее чем за 2 секунды) и Together AI (пост-тренинг как сервис на платформе AI Native Cloud).
Bron: NVIDIA blog — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws