метрикой становится «интеллект за доллар» (intelligence per dollar), который объединяет стоимость токена (cost per token) при инференсе и эффективность обучения. Платформа NVIDIA Vera Rubin, наследница Blackwell, спроектирована для этого сценария: она позволяет обучать крупнейшие модели с вчетверо меньшим числом GPU. В качестве примера приводится модель Nemotron 3 Ultra с 550 млрд параметров (архитектура MoE), показавшая 71,7% на SWE-bench verified. Платформа Vera Rubin использует интеграцию с библиотеками NeMo (NeMo Gym, NeMo RL) и оптимизирована для параллельных развёртываний тысяч сред. Партнёры — Prime Intellect (30% прироста пропускной способности на процессорах Vera по сравнению с x86), Perplexity (RL-стек с RDMA-синхронизацией весов менее чем за 2 секунды) и Together AI (пост-тренинг как сервис на платформе AI Native Cloud).