Hardware e InferênciaModelos 🇺🇸 24.07.2026 11:04

NVIDIA Vera Rubin: Máxima Inteligência por Dólar para IA Agêntica

NVIDIANVIDIA Prime IntellectPrime Intellect Perplexity AIPerplexity AI Together AITogether AI
A NVIDIA apresentou a plataforma Vera Rubin, projetada para o pós-treinamento contínuo de modelos de IA agêntica. A métrica chave passa a ser 'inteligência por dólar', combinando custo por token e eficiência de treinamento. A plataforma promete uma redução de quatro vezes na contagem de GPUs em comparação com a Blackwell.
NVIDIA в блоге объясняет, что для агентного ИИ пост-тренинг (post-training) — больше не разовый этап, а непрерывный процесс. В отличие от генеративных моделей, агентные модели должны планировать, использовать инструменты и адаптироваться к меняющимся условиям. Пост-тренинг включает циклы прямого и обратного проходов, где модель через обучение с подкреплением (RL) улучшает свои навыки. Ключевой метрикой становится «интеллект за доллар» (intelligence per dollar), который объединяет стоимость токена (cost per token) при инференсе и эффективность обучения. Платформа NVIDIA Vera Rubin, наследница Blackwell, спроектирована для этого сценария: она позволяет обучать крупнейшие модели с вчетверо меньшим числом GPU. В качестве примера приводится модель Nemotron 3 Ultra с 550 млрд параметров (архитектура MoE), показавшая 71,7% на SWE-bench verified. Платформа Vera Rubin использует интеграцию с библиотеками NeMo (NeMo Gym, NeMo RL) и оптимизирована для параллельных развёртываний тысяч сред. Партнёры — Prime Intellect (30% прироста пропускной способности на процессорах Vera по сравнению с x86), Perplexity (RL-стек с RDMA-синхронизацией весов менее чем за 2 секунды) и Together AI (пост-тренинг как сервис на платформе AI Native Cloud).
Fonte: NVIDIA blog — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas