GPU服务器里85%的NVMe在吃灰?龙存把它变成全局共享存储,不买一台存储服务器
「 GPU服务器自带的NVMe盘,平时利用率不到15%;龙存LoongStore把它们聚合成全局共享存储池,不买一台存储服务器,TCO直降40% 」
AI算力集群普遍存在的存储难题
在AI模型训练、HPC高性能科研场景中,绝大多数企业都面临严重的硬件资源浪费问题:
GPU 服务器标配多块大容量 NVMe SSD,日常仅用于临时缓存模型,磁盘闲置率超过85%;传统存算分离架构需要单独采购专用存储服务器、搭建独立存储网络,硬件、机柜、运维成本同步翻倍,跨网数据传输还会直接拖低GPU算力利用率。
能否不新增任何硬件,将服务器闲置本地磁盘统一转为全局共享存储?龙存科技依托多行业落地项目给出成熟解决方案。
适用场景
▶安装环境:英伟达以及国产 GPU 服务器
▶应用场景:HPC科研 & AI训练平台
▶存储需求:高性能文件共享,快速上线
两大落地真实案例
案例 1|某高校HPC小规模落地:10 台 GPU 服务器一键融合
某华北地区重点理工高校科研HPC集群部署10台GPU计算节点,项目预算有限,无法额外采购独立存储设备。龙存将LoongStore直接部署于现有GPU服务器,节点同时承担计算与存储双重能力,整合本地NVMe硬盘构建统一共享存储资源池,基于RDMA 网络,跨节点零拷贝直读。

落地收益
●无需新增存储硬件,当日完成部署并投入业务运行;
●本地磁盘直读数据,GPU 等待数据时间下降60%+,有效算力利用率显著释放;
●稳定连续运行3年,无底层架构故障,无额外运维工作量。
案例 2|某生物制药企业AI大规模落地:近百台 A100 集群规模化验证
某头部药企AI药物研发项目规划近百台A100算力集群,传统存储架构设备采购、实施周期长,整体硬件投入成本高昂。针对该大规模 AI 研发场景,龙存落地复用服务器本地闲置 NVMe 盘的存算融合架构,大幅降低硬件投入、缩短项目交付周期。
下表从硬件投入、磁盘利用率、交付周期、运维成本四大维度,直观对比两种架构差异:
|
|
|
|
|---|---|---|
| 存储服务器 | 额外采购专用存储节点 | 零新增服务器,GPU节点即存储 |
| 本地 NVMe 利用率 | <15%,仅作临时缓存 | 纳入全局统一存储池,实现 100% 利用率 |
| 交付周期 | 存储设备采购、上架、联调,周期长达数周 | 算力服务器部署完成即可投入使用 |
| 硬件与运维成本 | 存储硬件、机柜、网络、两套系统多重运维支出 | 省去独立存储,统一 UI 存算一体化运管 |
该项目已稳定落地运行,充分满足大模型训练高吞吐、低延迟业务需求,整体TCO下降40%以上,业务上线周期从数周压缩至1天。
龙存存算融合核心优势
19 年纯自研分布式存储,无硬件绑定
龙存深耕分布式存储领域19年,不捆绑自有服务器、虚拟化平台,兼容全品牌算力硬件,适配HPC、AI、数据库等各类业务场景。
内核适配 + 高性能用户态 IO 路径,无需部署容器/K8s,裸金属一键 RPM 安装
无需Docker、K8s容器环境,RPM安装包一键部署;数据访问链路简短,无多层转发损耗,资源占用低,原生适配裸金属服务器集群。
底层原生支持存算共存,性能互不抢占
存算融合为底层原生架构,非附加扩展功能;存算业务隔离调度,规避资源争抢造成的延迟卡顿,多年生产环境验证稳定可靠。
存算融合落地核心逻辑
●盘活闲置资源:充分利用GPU服务器自带NVMe闪存,彻底杜绝磁盘资源闲置浪费;
●构建统一资源池:LoongStore聚合全节点本地磁盘,形成全局统一数据命名空间;
●就近读写加速:优先读取本地磁盘数据,跨节点依靠RDMA高速互联,降低访问延迟;
●全面降本增效:取消独立存储服务器、存储网络整套硬件采购投入。
公司总部 · 北京
客服电话
400-803-6006
电子邮箱
market@loongstore.com.cn
丨 合作咨询