硬件与推理开源 🇺🇸 04.08.2026 19:02

随着AI对内存需求增加,存储技术升级

NVIDIANVIDIA
NVIDIA在FMS上发布了存储技术的进展,包括开源cuFile API以及由超过40家供应商参与的Storage-Next计划。这些举措旨在通过让存储成为数据路径的活跃部分,满足日益增长的AI需求,其中NVIDIA Vera CPU在压缩和加密流水线中的吞吐量提高了高达3.21倍。
在未来的内存与存储(FMS)会议上,NVIDIA宣布了新的存储进展,以应对人工智能日益增长的需求,这些需求需要大规模的数据集和超出系统内存的上下文窗口。该公司强调,存储系统必须高效地加密、压缩、验证和重建数据,当数千个AI代理同时访问存储时,这些操作可能成为瓶颈。NVIDIA的Vera CPU,作为NVIDIA Vera BlueField-4 STX的一部分,在两级压缩和加密流水线中提供了比x86 CPU高达3.21倍的吞吐量,使存储平台能够更高效地应对AI数据洪流。NVIDIA还宣布将其cuFile API(即GPUDirect Storage的一部分)开源,使GPU能够直接读写存储,访问时间达到微秒级。此外,NVIDIA推出了Storage-Next计划,与DDN、KIOXIA和Micron等40多家存储和闪存供应商合作,制定面向GPU驱动存储的互操作标准。该计划包括SCADA(规模化加速数据访问),这是一个框架,允许大规模并行GPU仅将必要的数据直接拉入其高速内存,并通过安全地分割访问过程来维护安全性。NVIDIA还提到了NVIDIA CMX上下文内存存储,这是一个AI原生的上下文层,用于基于NVIDIA STX构建的长上下文、多轮、代理式AI推理。
来源: NVIDIA blog — 原文
我们之前关于此话题的帖子 ↓
最新新闻