AMD y Cerebras se unen para desarrollar una plataforma de inferencia de IA de latencia ultrabaja
AMD y Cerebras Systems están creando una plataforma informática que combina los aceleradores AMD Instinct y los chips WSE de Cerebras basados en memoria SRAM para la inferencia de baja latencia de agentes de IA. La solución, disponible en Cerebras Cloud este año, genera cinco veces más tokens por vatio y requiere menos chips que sistemas similares de la competencia.
Cerebras Systems
NVIDIA
3DNews24.07 · 14:03
