Silk afirma que la inferencia de IA exige una infraestructura de datos fundamentalmente distinta
A medida que los agentes de IA pasan de ser chatbots a flujos de trabajo autónomos de múltiples pasos, las cargas de inferencia están saturando el almacenamiento en la nube tradicional (AWS EBS) con una concurrencia extrema, picos de lectura y latencia de cola. Silk aboga por un almacenamiento definido por software que separe el rendimiento de la capacidad para manejar estas demandas sin depender de réplicas de lectura frágiles ni de un aprovisionamiento excesivo.
NVIDIA
Silk

