NVIDIA Vera Rubin: максимум интеллекта за доллар для агентного ИИ

NVIDIANVIDIA Prime IntellectPrime Intellect Perplexity AIPerplexity AI Together AITogether AI
NVIDIA представила платформу Vera Rubin, спроектированную для непрерывного пост-тренинга агентных ИИ-моделей. Ключевой метрикой становится «интеллект за доллар», объединяющий стоимость токена и эффективность обучения. Платформа обещает снижение числа GPU вчетверо по сравнению с Blackwell.
NVIDIA в блоге объясняет, что для агентного ИИ пост-тренинг (post-training) — больше не разовый этап, а непрерывный процесс. В отличие от генеративных моделей, агентные модели должны планировать, использовать инструменты и адаптироваться к меняющимся условиям. Пост-тренинг включает циклы прямого и обратного проходов, где модель через обучение с подкреплением (RL) улучшает свои навыки. Ключевой
Показать ещё ↓
Сокращения
GPU = Graphics Processing Unit — графический процессор
MoE = Mixture of Experts — смесь экспертов
RL = Reinforcement Learning — обучение с подкреплением
RDMA = Remote Direct Memory Access — удалённый прямой доступ к памяти
Источник: NVIDIA blog — оригинал
Наши предыдущие публикации по теме ↓
Свежие новости