NVIDIA представила кластер Vera Rubin POD: пять стоек, семь чипов, 1,2 квадрлн транзисторов
NVIDIA
Groq
NVIDIA анонсировала кластер Vera Rubin POD, построенный на архитектуре MGX третьего поколения. В состав входят пять типов стоек: NVL72, LPX, Vera, STX и SPX, объединяющие 1152 GPU Rubin, 36 процессоров Vera и другие компоненты. Кластер обеспечивает производительность 60 Эфлопс и скорость интерконнекта 10 Пбайт/с.
NVIDIA представила Vera Rubin POD — кластер из пяти специализированных стоечных систем на архитектуре MGX третьего поколения. В состав входят стойки NVL72 (с 72 ускорителями Rubin и 36 процессорами Vera), LPX (с 256 ускорителями LPU для низкой задержки), Vera (до 256 процессоров для агентного ИИ), STX (накопитель на базе BlueField-4 для контекстной памяти) и SPX (сетевые стойки на Spectrum-X
Показать ещё ↓
- Сокращения
- POD = Performance Optimized Datacenter — производительный оптимизированный дата-центр
- MGX = Modular GPU eXchange — модульный обмен GPU
- GPU = Graphics Processing Unit — графический процессор
- CPU = Central Processing Unit — центральный процессор
- NVL = NVIDIA Virtual Link — виртуальная связь NVIDIA
- NVLink = NVIDIA NVLink — проприетарный интерконнект NVIDIA
- DPU = Data Processing Unit — блок обработки данных
- RAS = Reliability, Availability, Serviceability — надёжность, доступность, удобство обслуживания
- HBM = High Bandwidth Memory — высокопропускная память
- SRAM = Static Random-Access Memory — статическая память с произвольным доступом
- LPU = Language Processing Unit — блок обработки языка
- KV-кеш — кеш ключ-значение
- Ethernet = Ethernet — Ethernet (технология локальных сетей)
- InfiniBand = InfiniBand — InfiniBand (высокоскоростной интерконнект)
- PUE = Power Usage Effectiveness — эффективность использования энергии
- C2C = Chip-to-Chip — соединение чип-чип
Источник: ServerNews —
оригинал
