NVIDIA Vera Rubin: Maximale Intelligenz pro Dollar für agentische KI
NVIDIA
Prime Intellect
Perplexity AI
Together AI
NVIDIA hat die Vera-Rubin-Plattform vorgestellt, die für kontinuierliches Post-Training agentischer KI-Modelle ausgelegt ist. Die entscheidende Metrik wird „Intelligenz pro Dollar“, die Token-Kosten und Trainingseffizienz kombiniert. Die Plattform verspricht eine Vervierfachung der GPU-Anzahl im Vergleich zu Blackwell.
NVIDIA в блоге объясняет, что для агентного ИИ пост-тренинг (post-training) — больше не разовый этап, а непрерывный процесс. В отличие от генеративных моделей, агентные модели должны планировать, использовать инструменты и адаптироваться к меняющимся условиям. Пост-тренинг включает циклы прямого и обратного проходов, где модель через обучение с подкреплением (RL) улучшает свои навыки. Ключевой метрикой становится «интеллект за доллар» (intelligence per dollar), который объединяет стоимость токена (cost per token) при инференсе и эффективность обучения. Платформа NVIDIA Vera Rubin, наследница Blackwell, спроектирована для этого сценария: она позволяет обучать крупнейшие модели с вчетверо меньшим числом GPU. В качестве примера приводится модель Nemotron 3 Ultra с 550 млрд параметров (архитектура MoE), показавшая 71,7% на SWE-bench verified. Платформа Vera Rubin использует интеграцию с библиотеками NeMo (NeMo Gym, NeMo RL) и оптимизирована для параллельных развёртываний тысяч сред. Партнёры — Prime Intellect (30% прироста пропускной способности на процессорах Vera по сравнению с x86), Perplexity (RL-стек с RDMA-синхронизацией весов менее чем за 2 секунды) и Together AI (пост-тренинг как сервис на платформе AI Native Cloud).
Quelle: NVIDIA blog —
Original
