하드웨어 및 추론M&A 🇷🇺 24.07.2026 14:03

AMD와 Cerebras, 초저지연 AI 추론 플랫폼 개발을 위해 협력하다

Cerebras SystemsCerebras Systems NVIDIANVIDIA
AMD가 Cerebras Systems와 협력하여 AMD Instinct 가속기와 Cerebras의 SRAM 기반 칩을 결합한 컴퓨팅 플랫폼을 구축하고, AI 에이전트를 위한 초저지연 추론을 실현하고자 합니다. 이 공동 솔루션은 지난 12월 엔비디아가 200억 달러에 Groq를 인수한 후 AMD 포트폴리오의 공백을 메우는 것을 목표로 합니다.
AMD와 Cerebras Systems가 새로운 AI 추론 플랫폼에서 협력하고 있습니다. 이 플랫폼은 AMD Instinct 가속기와 Cerebras의 Wafer Scale Engine(WSE) 칩을 결합한 것으로, WSE는 HBM4(High Bandwidth Memory 4) 대신 온칩 SRAM(Static Random Access Memory)을 사용하여 훨씬 빠른 메모리 접근을 가능하게 합니다. 이번 파트너십은 엔비디아가 12월에 그록을 200억 달러에 인수한 이후 AMD 포트폴리오에 생긴 공백을 메우기 위한 것입니다. Cerebras의 CEO인 앤드루 펠드먼은 엔비디아를 비판하며 무기상에 비유했습니다. 결합된 시스템은 복잡한 쿼리를 AMD Instinct 가속기에서 처리하고, 토큰 생성을 Cerebras WSE에 위임하여 와트당 5배 더 많은 토큰을 생성합니다. 구체적인 수치는 아직 공개되지 않았지만, 이 솔루션은 올해 말 Cerebras Cloud에서 제공될 예정입니다. 이 플랫폼은 Groq 3의 LPU(Linear Processing Unit)와 결합된 엔비디아의 Vera Rubin과 경쟁하지만, AMD와 Cerebras는 자사 시스템이 Kimi K2.5와 같은 1조 개 파라미터 모델에 대해 수십 개의 칩만 필요로 하는 반면, Groq는 2,000개의 칩이 필요하다고 주장합니다.
출처: 3DNews — 원문
관련 게시물 ↓
새로운 뉴스