⚡ EILMELDUNG
Hardware & InferenzGeschäft & Markt 🇨🇳 27.07.2026 06:02

AMD stellt Helios mit weltweit erstem 2-nm-GPU MI455X vor: OpenAI, Meta und Microsoft sind Kunden

OpenAIOpenAI MetaMeta MicrosoftMicrosoft OracleOracle AnthropicAnthropic Taiwan Semiconductor Manufacturing CompanyTaiwan Semiconductor Manufacturing Company
AMD hat das Rack-Scale-System Helios mit dem Instinct MI455X-Beschleuniger vorgestellt, der angeblich die erste GPU mit 2-nm-Chiplets ist. Zu den Kunden gehören OpenAI, Meta, Microsoft und Oracle. Die Auslieferung wird für das dritte Quartal 2026 erwartet. Das System nutzt eine offene Architektur mit UALink und Ultra Ethernet und zielt darauf ab, die Dominanz von Nvidia herauszufordern.
Am 23. Juli 2026 veranstaltete AMD in San Francisco das Event „Advancing AI 2026“, bei dem CEO Lisa Su den neuen Beschleuniger Instinct MI455X und das Rack-Scale-System Helios vorstellte. Helios befindet sich nun in der Vollproduktion und wird ab Ende des dritten Quartals 2026 ausgeliefert. OpenAI, Meta, Microsoft und Oracle haben sich als Kunden verpflichtet, wobei OpenAI eine groß angelegte Bereitstellung ab Ende 2026 und eine Expansion im Jahr 2027 plant. Der MI455X verfügt über 320 Milliarden Transistoren in einem Chiplet-Design: vier XCD-Rechenchiplets auf TSMC N2 (2 Nanometer), zwei FCD-Cache- und Verbindungschiplets sowie I/O auf N3P (3 Nanometer) und 12 HBM4-Speicherstapel mit insgesamt 432 Gigabyte pro GPU. Helios integriert 72 MI455X-GPUs und 18 EPYC-Venice-CPUs (Zen 6, 256 Kerne, 2 Nanometer) und liefert 2,9 ExaFLOPS FP4 und 1,4 ExaFLOPS FP8. Das System nutzt offene Rack-Standards des Open Compute Project (OCP), UALink für die interne Skalierung und Ultra Ethernet für die externe Vernetzung, wobei AMDs Pensando-Netzwerkchips zum Einsatz kommen. AMD betonte ein offenes Ökosystem, um Cloud-Anbieter und Erstausrüster (Original Equipment Manufacturer, OEM) anzuziehen. Der MI455X unterstützt die CDNA-5-Architektur, 256 WGP-Recheneinheiten und eine Wellenfront (Wavefront) von 32 Threads (zuvor 64) mit einer Spitzenleistung von 40,26 PetaFLOPS MXFP4 pro GPU. Zu den wichtigsten Kunden zählen OpenAI (Multi-Generation-Deal über bis zu 6 Gigawatt, erstes Gigawatt in der zweiten Jahreshälfte 2026), Meta (bis zu 6 Gigawatt, benutzerdefinierte MI450-Serie), Oracle Cloud (50.000 MI450-GPUs ab dem dritten Quartal 2026) und Anthropic (strategische Partnerschaft über bis zu 2 Gigawatt ab 2027). AMD gewährte OpenAI und Meta zudem Optionsscheine (Warrants) für bis zu 160 Millionen AMD-Aktien und plant Investitionen von bis zu 5 Milliarden US-Dollar in Anthropic. AMDs Vizepräsident Andrew Dieckman behauptete, dass CUDA zu einem „Non-Event“ werde, da Entwickler zu höheren Frameworks wie PyTorch, vLLM und Triton übergehen, obwohl die langfristige Herausforderung des Software-Ökosystems weiterhin erheblich bleibt.
Quelle: InfoQ 中国 — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten