Fusies & OvernamesHardware & Inferentie 🇷🇺 24.07.2026 14:03

AMD en Cerebras bundelen krachten voor ultralage latentie AI-inferentieplatform

Cerebras SystemsCerebras Systems NVIDIANVIDIA
AMD en Cerebras Systems ontwikkelen een computerplatform dat AMD Instinct-versnellers en Cerebras WSE-chips combineert op basis van SRAM-geheugen voor inferentie met lage latentie van AI-agenten. De oplossing, die dit jaar beschikbaar is in Cerebras Cloud, genereert vijf keer meer tokens per watt en vereist minder chips dan vergelijkbare systemen van concurrenten.
AMD и Cerebras Systems объявили о совместной разработке вычислительной платформы, которая сочетает ускорители AMD Instinct и чипы Cerebras Wafer Scale Engine (WSE) со встроенной памятью SRAM. Платформа предназначена для инференса ИИ-агентов — этапа, требующего большого объёма быстрой памяти. По словам главы Cerebras Эндрю Фельдмана, проект закрывает пробел в портфеле AMD, возникший после покупки Nvidia стартапа Groq за $20 млрд. Чипы Cerebras WSE используют SRAM вместо HBM4, что обеспечивает скорость генерации более 2000 токенов в секунду. В гибридной системе сложные запросы обрабатываются на ускорителях AMD Instinct, а генерация токенов делегируется Cerebras WSE, что повышает энергоэффективность в пять раз (токенов на ватт). Для сравнения: для обслуживания модели Kimi K2.5 (1 трлн параметров) требуется две тысячи чипов Groq, а в системе AMD и Cerebras — всего несколько десятков. Объединённое решение станет доступно в Cerebras Cloud до конца года.
Bron: 3DNews — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws