Matériel et InférenceOpen Source 🇺🇸 04.08.2026 19:02

Alors que l'IA accroît les exigences en matière de mémoire, le stockage s'intensifie

NVIDIANVIDIA
NVIDIA dévoile des avancées en matière de stockage au FMS, notamment l'ouverture des API cuFile et l'initiative Storage-Next avec plus de 40 fournisseurs. Ces initiatives visent à répondre à la demande croissante de l'IA en faisant du stockage une partie active du chemin de données, le processeur NVIDIA Vera montrant jusqu'à 3,21 fois plus de débit dans les pipelines de compression et de chiffrement.
Lors de la conférence Future of Memory and Storage (FMS), NVIDIA a annoncé de nouvelles avancées en matière de stockage pour répondre aux demandes croissantes de l'IA, qui nécessite des ensembles de données massifs et des fenêtres de contexte dépassant la mémoire du système. La société a souligné que les systèmes de stockage doivent chiffrer, compresser, vérifier et reconstruire efficacement les données, ce qui peut devenir un goulot d'étranglement lorsque des milliers d'agents d'IA accèdent simultanément au stockage. Le processeur Vera de NVIDIA, faisant partie de NVIDIA Vera BlueField-4 STX, offre un débit jusqu'à 3,21 fois supérieur à celui d'un CPU x86 dans un pipeline de compression et de chiffrement en deux étapes, permettant aux plates-formes de stockage de gérer plus efficacement les flots de données de l'IA. NVIDIA a également annoncé qu'elle mettait en open source ses API cuFile, faisant partie de GPUDirect Storage, permettant aux GPU de lire et d'écrire directement dans le stockage avec des temps d'accès de l'ordre de la microseconde. De plus, NVIDIA a présenté Storage-Next, une initiative regroupant plus de 40 fournisseurs de stockage et de mémoire flash tels que DDN, KIOXIA et Micron, pour développer des normes interopérables pour le stockage piloté par GPU. L'initiative comprend SCADA (accès aux données accéléré et à grande échelle), un cadre qui permet aux GPU massivement parallèles de ne tirer que les données nécessaires directement dans leur mémoire à haute vitesse, en répartissant de manière sécurisée le processus d'accès pour maintenir la sécurité. NVIDIA a également mentionné NVIDIA CMX Context Memory Storage, un niveau de contexte natif IA pour l'inférence d'IA agentique à contexte long et multi-tours, construit sur NVIDIA STX.
Source: NVIDIA blog — original
Nos articles précédents sur ce sujet ↓
Infos fraîches