NVIDIA Vera Rubin: максимум интеллекта за доллар для агентного ИИ
NVIDIA
Prime Intellect
Perplexity AI
Together AI
NVIDIA представила платформу Vera Rubin, спроектированную для непрерывного пост-тренинга агентных ИИ-моделей. Ключевой метрикой становится «интеллект за доллар», объединяющий стоимость токена и эффективность обучения. Платформа обещает снижение числа GPU вчетверо по сравнению с Blackwell.
NVIDIA в блоге объясняет, что для агентного ИИ пост-тренинг (post-training) — больше не разовый этап, а непрерывный процесс. В отличие от генеративных моделей, агентные модели должны планировать, использовать инструменты и адаптироваться к меняющимся условиям. Пост-тренинг включает циклы прямого и обратного проходов, где модель через обучение с подкреплением (RL) улучшает свои навыки. Ключевой
Показать ещё ↓
- Сокращения
- GPU = Graphics Processing Unit — графический процессор
- MoE = Mixture of Experts — смесь экспертов
- RL = Reinforcement Learning — обучение с подкреплением
- RDMA = Remote Direct Memory Access — удалённый прямой доступ к памяти
Источник: NVIDIA blog —
оригинал
