英伟达刚发布的SCADA,让GPU绕过CPU直连硬盘,速度飙5倍
英伟达刚发布的SCADA,让GPU绕过CPU直连硬盘,速度飙5倍 8月5日的 FMS 2026 闪存峰会上,英伟达拿出了一套新架构——SCADA,并且全面开源,彻底打通了GPU直连SSD硬盘的数据通道,再也没有CPU这个中间商了。 以前的数据搬运,CPU 是绕不开的中转站 GPU 要读数据,传
💡 你将学到
英伟达刚发布的SCADA,让GPU绕过CPU直连硬盘,速度飙5倍 8月5日的 FMS 2026 闪存峰会上,英伟达拿出了一套新架构——SCADA,并且全面开源,彻底打通了GPU直连SSD硬盘的数据通道,再也没有CPU这个中间商了。 以前的数据搬运,CPU 是绕不开的中转站 GPU 要读数据,传
英伟达刚发布的SCADA,让GPU绕过CPU直连硬盘,速度飙5倍
8月5日的 FMS 2026 闪存峰会上,英伟达拿出了一套新架构——SCADA,并且全面开源,彻底打通了GPU直连SSD硬盘的数据通道,再也没有CPU这个中间商了。
以前的数据搬运,CPU 是绕不开的中转站
GPU 要读数据,传统流程是这样的:硬盘 → CPU 内存 → GPU 显存。CPU 不仅要当搬运工,还得负责调度指挥。
英伟达 2019 年就推出了 GPUDirect Storage(GDS),让数据可以绕过 CPU 内存,直接传输到 GPU。但 GDS 只解决了数据链路问题——指令控制还得 CPU 来发。在读写大文件时还好,可一旦碰到 AI 推理那种海量 512 字节小请求,CPU 调度就成了瓶颈。
打个比方,GDS 相当于给货物修了一条直通高速,但信号灯还是 CPU 在管。SCADA 则干脆把信号灯也交给了 GPU 自己。
SCADA 让 GPU 接管存储调度权
SCADA 的全称是英伟达自己定义的新存储架构,核心变化就一句话:GPU 直接发起存储 I/O 请求,自己管理 NVMe 硬盘的队列深度。 CPU 彻底不用管了。
实测数据很直观:在数据分析任务中,SCADA 模式的速度是传统 CPU 触发模式的 5.3 倍,硬件成本最高能降低 21.7 倍。
美光在现场展示了一个参考设计,用 3 颗 H100 显卡驱动了 44 块 PCIe Gen6 SSD,实现了 2.3 亿次随机读 IOPS,单台服务器的存储吞吐达到 118GB/s。负责调度的那颗 CPU 在整个过程中几乎处于空闲状态。
同时,英伟达把 GPU 存储加速 API cuFile 全面开源了。英特尔也加入了开源维护,cuFile 和 SCADA 从英伟达的私有技术变成了全行业通用标准。
40 家厂商联盟,一起为 GPU 时代重构存储
AI 推理中的 KV 缓存频繁产生小数据读写,传统硬盘用 4KB 扇区来读,会造成 8 倍的读取放大问题。英伟达为此成立了 Storage-Next 产业联盟,重点优化 512 字节扇区的读写表现。
联盟成员已超过 40 家,包括 DDN、铠侠、美光、三星,以及存储控制器企业、散热厂商和标准化组织。各方要共同制定一套新标准:当 GPU 取代 CPU 成为存储访问的主体时,固态硬盘该怎么适配。
硬件层面,英伟达打造了基于 Vera BlueField-4 存储处理器的 STX 架构系统,计划 2026 年下半年推出商用整机。
这套技术跟游戏玩家有关系吗?
很多人会问,GPU 直连硬盘对游戏有没有用?答案是:目前没有直接帮助,但理念相通。
SCADA 和 GDS 目前只支持 Linux 系统,不支持 Windows。而且英伟达这套技术只面向数据中心级硬件(Tesla/Quadro 卡),GeForce 游戏卡用不了。
不过微软已经做了类似的事——DirectStorage 就是专门为游戏设计的 GPU 直连存储技术,让 NVMe SSD 直接把纹理和模型数据喂给 GPU。而且 SCADA 强项是 512 字节小包(AI 推理场景),游戏加载的是大块数据,不是同一个痛点。
但未来如果游戏引擎开始集成实时 AI 推理(比如 AI NPC、实时生成场景),SCADA 降延迟的优势就会体现出来。GPU 直连存储,迟早会从数据中心走到你的游戏 PC 里。
真正的 AI 基础设施升级,不只是算力在涨,存力和运力也得跟上。SCADA 这一步,补齐了 AI 存储拼图的关键一块。
你觉得 GPU 直连存储的技术,未来会改变个人电脑的硬件架构吗?欢迎在评论区聊聊。
本站文章由编辑人工撰写,收录的工具均经过实测或公开资料核验。文中链接指向工具官网或 GitHub 仓库,仅作信息参考,不构成付费推广。
