AMD und Cerebras entwickeln gemeinsam eine Plattform für KI-Inferenz mit extrem niedriger Latenz
AMD und Cerebras Systems entwickeln eine Computerplattform, die AMD Instinct-Beschleuniger mit Cerebras WSE-Chips kombiniert, die auf SRAM-Speicher basieren, für die latenzarme Inferenz von KI-Agenten. Die Lösung, die in diesem Jahr in der Cerebras Cloud verfügbar sein wird, erzeugt fünfmal mehr Token pro Watt und benötigt weniger Chips als ähnliche Systeme von Wettbewerbern.
Cerebras Systems
NVIDIA
3DNews24.07 · 14:03
