AMD et Cerebras s'associent pour développer une plateforme d'inférence IA à ultra-faible latence
AMD et Cerebras Systems créent une plateforme de calcul qui combine les accélérateurs AMD Instinct et les puces WSE de Cerebras basées sur la mémoire SRAM pour l'inférence à faible latence des agents d'IA. La solution, disponible dans Cerebras Cloud cette année, génère cinq fois plus de tokens par watt et nécessite moins de puces que les systèmes similaires des concurrents.
Cerebras Systems
NVIDIA
3DNews24.07 · 14:03
