A medida que la IA aumenta las demandas de memoria, el almacenamiento da un paso adelante
NVIDIA
NVIDIA presenta avances en almacenamiento en FMS, incluida la apertura del código de las APIs cuFile y la iniciativa Storage-Next con más de 40 proveedores. Estas buscan satisfacer las crecientes demandas de la IA haciendo que el almacenamiento sea una parte activa de la ruta de datos, con la CPU NVIDIA Vera mostrando hasta 3,21 veces más rendimiento en pipelines de compresión y cifrado.
En la conferencia Future of Memory and Storage (FMS), NVIDIA anunció nuevos avances en almacenamiento para abordar las crecientes demandas de la IA, que requieren conjuntos de datos masivos y contextos de ventana que exceden la memoria del sistema. La compañía destacó que los sistemas de almacenamiento deben cifrar, comprimir, verificar y reconstruir datos de manera eficiente, lo que puede convertirse en un cuello de botella cuando miles de agentes de IA acceden al almacenamiento simultáneamente. La CPU Vera de NVIDIA, parte de NVIDIA Vera BlueField-4 STX, ofrece hasta 3.21 veces más rendimiento que una CPU x86 en un pipeline de compresión y cifrado de dos etapas, permitiendo que las plataformas de almacenamiento manejen las oleadas de datos de IA de manera más eficiente. NVIDIA también anunció que está liberando el código fuente de sus APIs cuFile, parte de GPUDirect Storage, lo que permite que las GPU lean y escriban directamente en el almacenamiento con tiempos de acceso en microsegundos. Además, NVIDIA presentó Storage-Next, una iniciativa con más de 40 proveedores de almacenamiento y flash como DDN, KIOXIA y Micron, para desarrollar estándares interoperables para el almacenamiento impulsado por GPU. La iniciativa incluye SCADA (scaled, accelerated data access), un marco que permite que las GPU masivamente paralelas extraigan solo los datos necesarios directamente en su memoria de alta velocidad, dividiendo de manera segura el proceso de acceso para mantener la seguridad. NVIDIA también mencionó NVIDIA CMX Context Memory Storage, una capa de contexto nativa de IA para inferencia de IA agéntica de contexto largo, multi-turno y autónoma, construida sobre NVIDIA STX.
Fuente: NVIDIA blog —
original
