九章云极陈静力:高性能存储破局算力“饥渴症”,让每一分算力投入都“看得见回报”

互联网
2026
07/19
21:25
分享
评论

上海,2026年7月18日——2026世界人工智能大会期间,“智联为擎 合一共进”AI网络前沿生态论坛如期举行。九章云极技术总监陈静力受邀发表主题演讲,面向政企、科研机构及AI厂商代表,拆解大模型训练推理中的存储瓶颈,并首次系统披露九章智算云3.0的“算力治理”闭环——从“算力能用”到“算力好用”的完整升级路径。

“许多企业以为多买GPU就能提速,结果钱花了,卡却常常在‘等数据’。”陈静力一开场就点破行业普遍误区。他解释,大模型训练像一条流水线:GPU是“工人”,存储是“传送带”。当传送带速度跟不上工人节奏,再多的工人也只能干等——这正是当前AI算力利用率偏低的根本原因。随着万亿参数模型、超长上下文推理、具身智能仿真等业务普及,海量数据涌入,传统存储“传送带”频繁卡顿,GPU空转、算力浪费成为行业常态。

1784437464683690.png

针对上述难题,九章云极交出两张“技术答卷”,分别对准训练与推理两大场景。DingoFS是专为AI训练打造的并行文件系统,深度适配PyTorch、Megatron-LM等主流框架,基于RDMA、RoCEv2高速网络实现数据“端到端零拷贝”——好比货物从仓库直达工位,无需中转搬运。实测数据显示:打满200Gb网卡带宽仅需1核CPU处理,传输4MB数据时延低至220微秒,较传统方案提速数倍。兼容POSIX标准接口,千卡、万卡级集群可稳定跑满,从源头消除训练中的“等数据”时间,GPU利用率显著提升。

DingoCache则是针对生成式AI推理中最耗时的KVCache读写环节,九章云极推出分布式缓存系统,采用无共享架构、CPU核心亲和调度、GPU直通加速等组合技术。基于vLLM标准压测数据:搭载DFKV后,推理总吞吐量提升1245.7%,首字生成时延(TTFT)下降93.4%——“相当于原来1套系统干的活,现在12套系统同时干,且用户几乎感觉不到等待”。超长文档问答、多轮对话等场景的推理卡顿问题由此彻底缓解,企业无需频繁加购推理卡即可支撑更大并发。

陈静力强调,存储能力之上,九章智算云3.0完成了从“提供算力”到“管好算力”的关键一跃。新增的智能队列调度、资源配额管理与开发工具套件三大治理能力形成协同:多团队提交任务时,系统自动排队、动态插队,好比医院智能分诊,避免资源争抢混乱;同时为各部门划定专属算力“额度”,杜绝单团队占满全部显卡;深度集成至Cursor、Trae等主流IDE后,开发者用自然语言即可完成云端调度,无需在多个页面间反复切换。三者协同让算力从“能租到”变为“用得好”,实测数据显示,某头部模型厂商依托九章智算云弹性算力体系,1至999卡GPU动态调度,综合成本最高节省82.1%。

DingoFS与DingoCache并非孤立产品,而是九章智算云完整AI基础设施的核心存储层。上层提供CCI云容器、DKS专属集群、VKS弹性推理、Serverless轻量化服务等多类算力形态,适配高校科研、智能制造、自动驾驶、医药研发、具身智能等十余类行业。底层依托自研高性能存储与200G/400G高速网络,实现2分钟快速申请资源、按需伸缩、按量计费——零基础企业也能低成本起步。

依托“AI工厂”双引擎战略与DCU统一算力计量标准,存储加速、调度治理、算力供给深度协同,形成可量化、可治理、可普惠的AI工业化体系,帮助各类用户避开硬件冗余投入,以最优存算配比实现业务落地。

演讲最后,陈静力表示AI产业高质量发展离不开开放协同的底层生态。九章云极将持续开放DingoFS与DingoCache适配接口,面向大模型厂商、智算中心运营商及垂直行业伙伴提供深度适配服务,联合产业链上下游共同推进AI训推全链路存算标准优化,合力破解算力浪费、落地成本高、技术锁定等共性难题。

THE END
广告、内容合作请点击这里 寻求合作
免责声明:本文系转载,版权归原作者所有;旨在传递信息,不代表砍柴网的观点和立场。

相关热点

相关推荐

1
3