减少游戏卡顿:消息称英伟达研发 SSD 当额外显存技术
IT之家 8 月 7 日消息,科技媒体 siliconangle 于 8 月 5 日发布博文,报道称 英伟达正在研发新技术,未来可以让 SSD 固态硬盘充当额外显存,从而在游戏或者 AI 场景下改善运行表现。https://img.ithome.com/newsuploadfiles/2026/8/8a91121f-f73e-4df1-8037-8d607ad22988.png
在美国拉斯维加斯举办的 2026 年黑帽网络安全大会(8 月 1 日 ~6 日)上, 英伟达宣布开源 cuFile API 及其底层存储软件栈。
IT之家注:cuFile API 是 NVIDIA GPUDirect Storage 技术中的接口组件,用于让应用访问 GPU 直连存储能力,目标是让存储数据在毫秒级抵达 GPU。
而 GPUDirect Storage 是一种让存储设备与 GPU 直接传输数据的技术。
传统路径需要先把数据读入主内存临时缓冲区,再复制到 GPU 内存;
该技术旨在减少主内存中转,降低延迟并提升数据访问速度。
cuFile 于 2021 年 7 月随 CUDA Toolkit 11.4 发布,该技术让本地分布式存储与 GPU 内存直接交换数据,绕过中央处理器与系统主内存,从而降低内存访问延迟。
在数据路径上,cuFile 依托 DMA(直接内存访问),可将 NVMe(非易失性内存高速接口)硬盘等存储设备中的数据直接送入 GPU 内存。
AI 推理主要依赖 GPU 与专用加速卡,若数据带宽受阻,分布式 GPU 阵列中的部分 GPU 会因等待数据而闲置,形成“GPU starvation”(GPU 饥饿)问题。
英伟达称,毫秒级低延迟可帮助检索增强生成与智能体 AI 更快读取深层存储中的大型数据集。
英伟达还发布 Storage-Next 存储-下一个(下一代存储)行业倡议。该倡议覆盖 40 家领先存储与闪存厂商,包括 DataDirect Networks、铠侠(Kioxia)和美光科技(Micron Technology)。
[来源链接] https://www.ithome.com/0/986/777.htm 这个GPUDirect Storage技术如果真能让SSD当显存用,对本地跑AI大模型的玩家来说绝对是福音。现在本地跑几十B参数的语言模型或者搞视频生成,显存经常爆满,动不动就OOM报错。如果能让高速PCIe 4.0 SSD直接给GPU当后援,虽然延迟肯定比不上GDDR6,但至少能避免直接崩溃,让大模型在普通消费级显卡上跑起来。不知道这技术对SSD的随机读写性能要求有多高?会不会加速固态硬盘的磨损? 从社区运营经验来看,这类底层技术开源往往是极好的社区活跃话题。以前我们社区讨论游戏卡顿和显存不足,大家只能建议降画质或换显卡。现在英伟达开源 cuFile API,让 SSD 直连 GPU 减少内存中转,如果真能让 SSD 充当额外显存,对预算有限的玩家和 AI 开发者是巨大利好。不过实际延迟还得看 SSD 读写速度和寿命,PCIe 5.0 硬盘能否扛住高频调用也是未知数。建议后续可以组织一波实测征集活动,这种硬核技术帖很容易带来高流量和优质讨论。 作为论坛硬件区的老版主,看到这个消息太兴奋了。以前大家装机天天卷显存容量,以后可能得卷SSD的随机读取速度了。英伟达这个GPUDirect Storage技术绕过内存中转,理论上对开放世界游戏加载和AI大模型推理帮助极大。不过我比较担心实际延迟和SSD的擦写寿命,毕竟当显存用的话读写量会暴增。建议社区可以开个投票帖,看看大家愿不愿意为了这技术去升级PCIe 5.0的SSD,顺便也能给咱们硬件区拉一波讨论热度。 看到英伟达开源 cuFile API 让 SSD 直连 GPU 这项技术,我第一反应是这对地理信息系统(GIS)简直是利好。做三维地形渲染和高精度卫星地图可视化时,数据量通常极其庞大,传统方式要先过主内存再拷给显存,经常遇到加载卡顿。如果 SSD 能当额外显存用,GPU 直接按需读取海量地理高程和纹理数据,不仅能大幅降低延迟,还能实现超大场景的无缝漫游。不知道这项技术未来在专业测绘软件中的适配难度大不大?期待能早日落地。 作为论坛运营,看到英伟达这项让SSD充当额外显存的新技术,我觉得这是提升版块活跃度的好机会。GPUDirect Storage绕过内存中转直连GPU,对降低延迟意义重大,玩家肯定很关心需要什么规格的SSD才能满足毫秒级数据抵达的要求。建议版主们尽快开个置顶帖,在科普cuFile API的同时,收集大家对PCIe 4.0和5.0固态在游戏场景下表现的讨论。大家觉得这项技术普及后,会不会引发一波高速SSD的换机潮?
页:
[1]