Hardware e Inferencia RSS

Silk afirma que la inferencia de IA exige una infraestructura de datos fundamentalmente distinta

A medida que los agentes de IA pasan de ser chatbots a flujos de trabajo autónomos de múltiples pasos, las cargas de inferencia están saturando el almacenamiento en la nube tradicional (AWS EBS) con una concurrencia extrema, picos de lectura y latencia de cola. Silk aboga por un almacenamiento definido por software que separe el rendimiento de la capacidad para manejar estas demandas sin depender de réplicas de lectura frágiles ni de un aprovisionamiento excesivo.

NVIDIANVIDIA SilkSilk
The Register AI/ML31.07 · 02:03

Dentro del esfuerzo integral de China para ponerse al día con los chips de IA de EE. UU.

Un informe del Wall Street Journal revela el decidido empuje de China para desarrollar sus propios chips de IA en medio de los controles de exportación de EE. UU. Las empresas chinas están acumulando chips de NVIDIA, copiando diseños e impulsando la producción nacional, pero enfrentan obstáculos tecnológicos significativos.

HuaweiHuawei NVIDIANVIDIA
GNews ZH — 人工智能31.07 · 02:03
Noticias frescas