AMD en Cerebras bundelen krachten voor ultralage latentie AI-inferentieplatform
AMD en Cerebras Systems ontwikkelen een computerplatform dat AMD Instinct-versnellers en Cerebras WSE-chips combineert op basis van SRAM-geheugen voor inferentie met lage latentie van AI-agenten. De oplossing, die dit jaar beschikbaar is in Cerebras Cloud, genereert vijf keer meer tokens per watt en vereist minder chips dan vergelijkbare systemen van concurrenten.
Cerebras Systems
NVIDIA
3DNews24.07 · 14:03
