
8月5日机锋网消息,英伟达在FMS 2026峰会上宣布,将GPU存储加速API cuFile全面开源国内正规配资公司,同时公布SCADA全新存储架构,彻底打破传统CPU主导IO的传输瓶颈,实测场景下GPU存储IOPS最高实现5倍提升。
长期以来,GPU读取数据必须通过CPU进行调度,这种宿主模式在处理AI推理产生的大量512字节微小请求时,会造成严重的微秒级延迟。虽然之前的GPUDirect Storage(GDS)实现了数据链路的CPU绕过,但指令控制仍需CPU参与,使得系统在小粒度读写任务中提前触发性能瓶颈、IO资源率先耗尽。
此次推出的SCADA技术彻底解决了这一难题,SCADA允许GPU直接发起存储I/O请求,管理NVMe硬盘的队列深度。实测数据显示,在处理数据分析任务时,SCADA的速度是CPU触发模式的5.3倍,而硬件成本最高可降低21.7倍。在美光展示的参考设计中,使用3颗H100显卡成功驱动了44块PCIe Gen6 SSD,实现了惊人的2.3亿次随机读IOPS,单台服务器存储吞吐达到118GB/s,且负责调度的单颗CPU几乎处于空闲状态。
针对AI推理中KV缓存频繁产生的小数据读写,英伟达正式推出Storage-Next产业联盟计划,重点优化512字节扇区的读写表现,以解决传统硬盘在4KB扇区下造成的8倍读取放大问题。该构想最早在2025年GTC大会提出,目前联盟成员已超40家闪存与存储厂商,包含DDN、铠侠、美光,各方将共同制定GPU取代CPU成为存储访问主体时固态硬盘的适配标准。
硬件层面上国内正规配资公司,为承载cuFile开源生态与SCADA架构落地,英伟达打造了基于Vera BlueField-4存储处理器的STX架构系统,并计划在2026年下半年正式推出商用整机。目前英特尔也已加入开源组织并参与代码维护,标志着传统CPU主导IO调度的格局被颠覆。但该技术的规模化普及仍受两大核心条件制约,一是STX+SCADA新架构的跨硬件适配进度,二是美光、三星等厂商能否针对512字节小包场景完成主控与固件的底层重写。
天创网提示:文章来自网络,不代表本站观点。