32 узла высотой 1U с СЖО и бескабельной конструкцией MGX. Чип Groq 3 LPU построен на SRAM-памяти объёмом 500 Мбайт с пропускной способностью 150 Тбайт/с, без кешей и иерархии, что позволяет явно перемещать данные под управлением компилятора. Определяющей характеристикой LPU является детерминизм — отсутствие вариативности во время выполнения за счёт переноса всех решений на компилятор и использования плезиохронного C2C-протокола. Ключевая инновация — фазовая дезагрегация декодирования (AFD), которая отделяет механизм внимания, выполняемый на GPU, от FFN/MoE-операций, обрабатываемых на LPX. Это позволяет GPU абсорбировать растущие объёмы контекста, в то время как нагрузка на LPU остаётся постоянной и не зависит от длины контекста. Для практического использования гетерогенного декодирования NVIDIA Dynamo обеспечивает оркестрацию запросов, распределение работы и поддержание стабильной задержки при интенсивном трафике. В комбинации Vera Rubin NVL72 с Groq 3 LPX обеспечивают в 35 раз более высокую пропускную способность по сравнению с Grace Blackwell NVL72 при 400 TPS на пользователя, и до 10 раз больший доход на МВт для чувствительных к задержкам нагрузок.