AMD apresenta acelerador de IA Instinct MI455X com 432 GB HBM4 e desempenho de até 40 PFLOPS
A AMD revelou seus aceleradores de IA Instinct MI455X para data centers, baseados na arquitetura CDNA 5, com 432 GB de memória HBM4 e desempenho máximo de até 40 PFLOPS em MXFP4. A GPU inclui 320 bilhões de transistores, usa um design multi-chiplet com processos TSMC N2 e N3P, e oferece uma melhoria de 2,9x na largura de banda de memória em relação à geração anterior. Além disso, a AMD anunciou o Instinct MI430X para cargas de trabalho de IA científica e soberana.
A AMD apresentou os aceleradores de IA Instinct MI455X para data centers, baseados na arquitetura CDNA 5, voltados para treinamento e inferência de IA em larga escala e sistemas em escala de rack. Cada acelerador possui 432 GB de memória HBM4 com largura de banda de pico de 23,3 TB/s. A GPU contém 320 bilhões de transistores e utiliza um design multi-chiplet: oito dies de complexo acelerador (ACD - Accelerator Complex Die) fabricados no processo N2 (2nm) da TSMC, dois chiplets de interconexão e dois chiplets de E/S no processo N3P (3nm) da TSMC. Ela conta com 256 unidades de computação Work Group Processor (WGP), 192 MB de cache L2 divididos em dois blocos de 96 MB, 12 pilhas de memória HBM4 por meio de uma interface de 192 canais, e suporta PCIe Gen 6 e rede UALink. O desempenho atinge 20,13 PFLOPS em MXFP8/MXFP6 e 40,26 PFLOPS em MXFP4. Comparado ao Instinct MI355X, o MI455X oferece 1,5x mais memória, 2,9x maior largura de banda de memória e 4x mais desempenho em MXFP8/MXFP4. Os novos recursos do CDNA 5 incluem Tensor Data Mover para transferência assíncrona de dados, clustering de grupos de trabalho, multicast, pré-busca de dados, barreiras divididas e um processador de comandos para menor latência. Os aceleradores suportam particionamento espacial em uma, duas ou oito partições (modos NPS1 e NPS2). A AMD também anunciou o Instinct MI430X para computação científica, IA soberana e cargas de trabalho de IA-HPC, alegando desempenho de 288 TFLOPS em FP64, mas sem detalhar a configuração de memória.
Fonte: 3DNews —
original
