⚡ EN DIRECT
AMD dévoile Helios avec le premier GPU 2nm au monde MI455X : OpenAI, Meta et Microsoft parmi les clients
OpenAI
Meta
Microsoft
Oracle
Anthropic
Taiwan Semiconductor Manufacturing Company
AMD a lancé le système rack-scale Helios équipé de l'accélérateur Instinct MI455X, présenté comme le premier GPU doté de chiplets en 2 nm. Les clients incluent OpenAI, Meta, Microsoft et Oracle, avec des livraisons attendues à partir du troisième trimestre 2026. Le système utilise une architecture ouverte avec UALink et Ultra Ethernet, visant à défier la domination de Nvidia.
Le 23 juillet 2026, AMD a organisé l'événement Advancing AI 2026 à San Francisco, où la PDG Lisa Su a annoncé le nouvel accélérateur Instinct MI455X et le système rack-scale Helios. Helios est désormais en production complète et commencera à être expédié fin du troisième trimestre 2026. OpenAI, Meta, Microsoft et Oracle se sont engagés en tant que clients, OpenAI prévoyant un déploiement à grande échelle à partir de fin 2026, avec une expansion en 2027. Le MI455X intègre 320 milliards de transistors grâce à une conception à puces multiples : quatre puces de calcul XCD sur le procédé TSMC N2 (2 nm), deux puces de cache/interconnexion FCD et d'entrée-sortie sur N3P (3 nm), et 12 empilements de mémoire HBM4 totalisant 432 Go par GPU. Helios intègre 72 GPU MI455X et 18 CPU EPYC Venice (Zen 6, 256 cœurs, 2 nm), offrant 2,9 ExaFLOPS FP4 et 1,4 ExaFLOPS FP8. Le système utilise les standards de rack ouvert OCP, UALink pour la mise à l'échelle interne et Ultra Ethernet pour la mise en réseau externe, avec des puces réseau AMD Pensando. AMD a souligné l'importance d'un écosystème ouvert pour attirer les fournisseurs de cloud et les fabricants d'équipements d'origine. Le MI455X prend en charge l'architecture CDNA 5, 256 unités de calcul WGP et un front d'onde à 32 threads (contre 64 auparavant), avec une performance maximale de 40,26 PFLOPS MXFP4 par GPU. Les clients clés incluent OpenAI (contrat multi-générationnel allant jusqu'à 6 GW, premier GW au second semestre 2026), Meta (jusqu'à 6 GW, série MI450 personnalisée), Oracle Cloud (50 000 GPU MI450 à partir du troisième trimestre 2026) et Anthropic (partenariat stratégique jusqu'à 2 GW à partir de 2027). AMD a également accordé des bons de souscription d'actions pouvant atteindre 160 millions d'actions AMD à OpenAI et Meta, et prévoit un investissement allant jusqu'à 5 milliards de dollars dans Anthropic. Le vice-président d'AMD, Andrew Dieckman, a affirmé que CUDA devient « un non-événement » alors que les développeurs se tournent vers des frameworks de plus haut niveau comme PyTorch, vLLM et Triton, bien que le défi à long terme de l'écosystème logiciel reste important.
Source: InfoQ 中国 —
original
