AI存储革新:NVIDIA加速计算与存储架构新突破
As AI Increases Demands on Memory, Storage Steps Up
NVIDIA在FMS大会上展示存储新技术,应对AI对内存和存储的激增需求。Vera CPU在压缩加密管道中性能提升3.21倍,开源cuFile API实现GPU直接访问存储,并推出Storage-Next计划及SCADA框架,确保安全高效的数据访问,推动AI存储基础设施发展。
深度解读
AI存储正从被动仓库变成主动数据路径的参与者,而NVIDIA在FMS 2026上的一系列动作——开源cuFile API、推出Storage-Next计划与SCADA框架——本质上是在定义下一代AI工厂的存储标准,让GPU绕过CPU直接以微秒级速度访问海量数据,同时用安全架构堵住直连带来的内存越界漏洞。
传统存储架构的瓶颈早已不是容量,而是数据吞吐的效率和安全性。当AI智能体同时发起数千个并发存储请求时,存储系统必须持续进行加密、压缩、校验和重建,这些数据服务在x86 CPU上会成为严重瓶颈。NVIDIA公布的基准测试显示,其Vera CPU在两阶段压缩加密流水线上比x86 CPU快3.21倍——这意味着存储平台可以用更少的计算资源吸收更大的AI数据洪流,而Vera BlueField-4 STX正是这一能力的载体。
四十年前,数据放在内存还是硬盘的决策以分钟级访问时间衡量;如今,在NVIDIA GPU与AI存储方案的配合下,这个权衡已经缩小到微秒级。SCADA框架的核心逻辑是让大规模并行GPU直接从存储中拉取应用所需数据到自身高速内存,而不是把所有数据都搬进内存再筛选——这彻底改变了AI数据集的处理经济学,使存储从"被动等待读取"变为"主动按需供给"。
开源cuFile:从闭源壁垒到生态共识
NVIDIA宣布开源的不仅是cuFile API,还包括其底层的垂直存储软件栈。cuFile作为GPUDirect Storage的开源组件,能利用数十万GPU线程和高速带宽内存,在微秒级时间内安全访问存储数据。这一步棋的深意在于:过去存储厂商各自为政,GPU直连存储的软件接口碎片化严重;现在NVIDIA把标准拱手让出,邀请Google、Intel、Meta作为初始维护者共同优化,实质上把竞争从"接口之争"转向"实现之争"。
开源的直接受益者是AI安全防御体系。快速、安全的数据访问是预防性和检测性网络安全措施的基础,而cuFile的开放性让安全上下文、数据和存储能以AI防御所需的速度被访问——这正好呼应了NVIDIA参与的Open Secure AI Alliance,该联盟正在制定AI安全透明度指南,存储层的安全性能直接影响AI系统能否在攻击发生时快速响应。
Storage-Next:40家厂商的"存储宪法"
Storage-Next计划更像一场行业标准的制定运动。NVIDIA联合DDN、KIOXIA、Micron等40多家存储和闪存厂商,加上控制器供应商、散热设计、编排运营方和标准机构,共同定义GPU驱动的存储行为规范。这不是简单的技术合作,而是试图把NVIDIA对存储的认知上升为全行业互操作标准——一旦形成,任何AI存储方案若不符合这套规范,就可能在生态中边缘化。
DDN的案例展示了SCADA的实际落地:其Infinia平台与SCADA集成,消除了大规模存储瓶颈。DDN首席技术官Sven Oehme的话点破了本质:"AI成功不取决于拥有多少基础设施,而取决于使用效率。"SCADA让GPU只拉取必要数据,直接提升算力利用率,这意味着企业的AI投资回报率计算方式将改变——不再看存储容量和GPU数量,而是看单位算力产出的有效洞察量。
安全与速度的平衡术
SCADA最精巧的设计在于安全机制。直连存储速度快,但若应用直接读写驱动,可能覆盖其他进程的内存——这是致命安全漏洞。SCADA的解法是职责分离:需要原始速度的用户应用部分留在可信计算基之外,而一个特权组件在设置阶段配置好用户应用与其被批准存储之间的保护性访问,遵循标准Linux安全协议。这既保留了速度优势,又确保了隔离性。
这种设计对AI工厂至关重要。当数千个智能体同时访问存储时,任何安全漏洞都可能被放大为系统性风险。SCADA让安全策略在AI数据路径中持续执行,而不是事后补救——这与NVIDIA统一的DOCA安全栈配合,使Vera BlueField-4 STX成为AI原生的数据平台基础,支持长上下文、多轮对话的智能体推理。
所以呢:存储成为AI竞争力的新战场
这些技术动作的行业含义远超存储本身。当GPU能直接高效访问存储时,AI系统的整体性能瓶颈将从计算转移到数据供给,而NVIDIA正在把存储基础设施变成其AI霸权的新护城河——通过开源cuFile和Storage-Next,它既定义了技术标准,又绑定了合作伙伴。对于存储厂商,不加入这个生态就可能被排除在AI数据中心的主流采购清单之外;对于企业用户,选择存储方案不再只看容量和价格,更要看能否无缝对接GPU直连架构。
AI工厂的产出质量取决于输入数据的质量和时效。SCADA和cuFile让模型能实时访问大规模数据集,这意味着上下文窗口可以无限扩展,智能体可以处理更复杂的多轮任务。未来两年,存储架构的选型将直接决定AI应用的响应速度和准确性——这不再是一个后台IT决策,而是直接影响AI竞争力的战略选择。
