AMD e Cerebras unem forças para desenvolver plataforma de inferência de IA com latência ultrabaixa
A AMD e a Cerebras Systems estão criando uma plataforma de computação que combina aceleradores AMD Instinct e chips Cerebras WSE baseados em memória SRAM para inferência de baixa latência de agentes de IA. A solução, disponível na Cerebras Cloud ainda este ano, gera cinco vezes mais tokens por watt e requer menos chips do que sistemas similares de concorrentes.
Cerebras Systems
NVIDIA
3DNews24.07 · 14:03
