NVIDIA представила кластер Vera Rubin POD: семь чипов, пять стоек, один ИИ-суперкомпьютер

NVIDIANVIDIA GroqGroq
NVIDIA анонсировала Vera Rubin POD — кластер из пяти специализированных стоечных систем на архитектуре MGX третьего поколения для агентного ИИ. Кластер включает 40 стоек, 1,2 квадриллиона транзисторов, 1152 GPU Rubin и обеспечивает производительность 60 Эфлопс. В состав входят стойки NVL72, LPX, Vera, STX и SPX, объединённые высокоскоростными интерконнектами.
NVIDIA представила Vera Rubin POD — кластер из пяти специализированных стоечных систем на архитектуре MGX третьего поколения для эры агентного ИИ. Кластер включает 40 стоек, 1,2 квадриллиона транзисторов, почти 20 тысяч кристаллов NVIDIA и 1152 GPU Rubin, обеспечивая ИИ-производительность 60 Эфлопс и агрегированную скорость интерконнекта около 10 Пбайт/с. В состав входят пять типов стоек: MGX NVL (включая Vera Rubin NVL72 с 72 ускорителями Rubin и 36 процессорами Vera, объединяемыми в домен NVL576 через NVLink 6), MGX ETL (совместимая со сторонними чипами, с Ethernet Spectrum-X или проприетарным интерконнектом RealScale для Groq 3 LPU), стойка Vera (до 256 процессоров, обслуживающая более 22,5 тысяч RL-сред для агентов), стойка STX на базе BlueField-4 и Spectrum-X Ethernet с контекстной памятью CMX, и сетевые стойки SPX с коммутаторами Spectrum-6 или Quantum-X800 InfiniBand. Vera Rubin NVL72 обеспечивает до 4 раз лучшую производительность обучения и до 10 раз лучшую производительность инференса на Ватт по сравнению с Blackwell, а также в десять раз меньшую стоимость токена. Стойки MGX используют динамическое управление питанием, интеллектуальное сглаживание энергопотребления с конденсаторами (400 Дж на GPU) и жидкостное охлаждение горячей водой (+45°C на входе). Выход Vera Rubin NVL72 запланирован на вторую половину 2026 года. Для масштабирования за пределы NVL576 предусмотрена стойка Kyber с оптическим интерконнектом для будущих поколений.
Сокращения
POD = Performance Optimized Data center — производительно-оптимизированный центр обработки данных (устоявшееся название кластера)
MGX = Modular GPU eXchange — модульный обмен GPU (архитектура стоек NVIDIA)
NVL = NVIDIA Virtual Link — виртуальная связь NVIDIA (тип стойки с NVLink)
ETL = Ethernet Tensor Link — тензорная связь по Ethernet (тип стойки с Ethernet)
DPU = Data Processing Unit — блок обработки данных
HBM = High Bandwidth Memory — память с высокой пропускной способностью
CPO = Co-Packaged Optics — совместно упакованная оптика
KV-кеш — кэш ключ-значение
PUE = Power Usage Effectiveness — эффективность использования энергии
C2C = Chip-to-Chip — чип-к-чипу (межчиповое соединение)
Источник: ServerNews — оригинал

Наши прошлые публикации по теме

Есть свежие новости