7月17日至20日,2026世界人工智能大会(WAIC 2026)在上海世博、张江、西岸三地四馆同步启幕。大会由多部委联合上海市政府共同主办,汇聚超140场重磅论坛、1400余位中外嘉宾。在十万平方米超大展区内,1100余家企业集中参展,其中智算与具身智能两大赛道各汇聚超200家企业,集中展示了人工智能赋能千行百业的前沿实践。
张江科学会堂作为本届WAIC的智能算力芯引擎,聚焦智算发展与硬科技创新主线,集中呈现算力底座、自主可控、软硬协同和全栈整合能力,是业内洞察国产算力创新、技术商用实践的核心窗口。作为智能计算领域的坚实力量,超云携全栈大模型推理落地解决方案亮相“技术之芯”张江会场,以“让AI更简单”为价值内核,完整展出全栈自主算力自研成果与成熟行业落地实践。

从“拼参数”到“拼落地”,AI算力迈入全新周期
当前人工智能行业已告别单纯比拼模型参数的发展阶段,全面进入“拼落地”的全新周期。企业在大模型落地商用过程中,普遍遭遇GPU显存物理瓶颈、国产算力优化等方面难题,行业“推理焦虑”凸显。
“我们在本届WAIC大会上,展示了业界率先完成的AI推理存算分离全栈系统工程验证。联合生态伙伴,通过‘PD分离+KV Cache卸载’这一核心技术架构,实现了系统级的创新突破。”超云总裁房玉震现场接受媒体采访时介绍道,通过“以存助算”的架构创新,打破了GPU显存的“围墙”。这不仅是性能的跃升,更是国产算力在系统级优化上的重大突破,真正实现了软硬协同的全栈自主。

这一系列技术成果的背后,是超云对国产AI发展的坚定聚焦。房玉震表示,超云的价值主张是“让数据中心更简单”,在AI时代,我们更致力于“让AI更简单”——不仅提供高端的推理引擎,也推出了面向中小企业的轻量化Agent方案,全方位降低全行业AI使用门槛,推动人工智能普惠千行百业。
全栈大模型推理落地方案,破解行业“推理焦虑”难题
依托上下游生态协同,超云已构筑起完整的国产化算力生态链。在本届WAIC大会上,超云展示了完整的全栈大模型推理落地方案,以“全栈推理+场景适配”为核心,全方位呈现大模型推理从底层算力到产业落地的全链路解决方案。
整套方案以四大核心硬件为支柱,构建起覆盖全业务场景的完整链路:
● R8829 G13 16卡服务器:采用高密度多卡互联,大幅缩短首Token生成延迟;
● CS13000-S高性能全闪存储:作为整套方案的核心,通过GPU直存技术实现KV缓存动态卸载,彻底突破显存容量限制,解决长上下文推理卡顿难题;
● R8968 G14高密度解码服务器:支持多类型加速卡混合部署,保障万级并发的高效输出;
● R8424 G12一体化AI工作站:专为中小企业打造,开箱即用,可以快速落地轻量级智能应用。
通过计算与存储分层协同,方案打破了传统靠堆叠显卡提升推理能力的传统思路,实现了算力资源的高效调度。无论是支撑互联网平台超高并发推理,还是适配制造、政务等领域的国产化私有算力部署,乃至面向中小微企业推出轻量化Agent工作站,均能灵活覆盖大、中、小各类业务场景,满足从低配到高配的多样化算力需求。
方案围绕“算力规划—智算底座搭建—AI应用赋能”形成全周期技术闭环,全面承载AI训练、大模型推理、高性能计算等核心任务,持续赋能政务、金融、能源、互联网等千行百业,加速其智能化转型进程。


集结“豪华算力朋友圈”,共建AI算力落地生态
当前,行业普遍面临一个现实难题:企业手中虽有大模型,却缺乏一套能够贯通底层硬件到上层应用的一站式算力基础设施,单一厂商的技术路径往往难以独立支撑全链条部署。为此,超云以自研全栈异构算力底座为核心,集结产业链关键环节的头部伙伴,构建起覆盖全链路的“豪华算力朋友圈”,全景式展现大模型落地过程中的协同价值。
展会期间,超云方案与生态部总经理张春雨带队辗转世博、张江双馆,与各生态伙伴展开深度对话,围绕底层芯片、智算基建、云原生调度、公有云算力、系统级加速及行业AI应用六大维度,就软硬协同中的实际痛点与联合创新方向进行务实探讨,直观呈现了产业链协同如何真正打通AI落地的“最后一公里”。
此外,张春雨还受邀出席“科华数据算力基础设施与AI芯片协同发展论坛”,并发表了主题演讲。他围绕智算底座、液冷节能及全场景解决方案等核心议题,深度解码了AI大爆发下的算力供需格局,展现了超云携手生态伙伴筑牢AI时代IT基础设施根基的完整布局。

现场,超云还同步开放了互动体验区,搭配定制版“超小云”周边礼品,吸引了大量行业从业者与技术开发者驻足交流。


想要破解行业“推理焦虑”难题,全产业链深度协同与软硬一体化融合,正是破局的关键所在。面向未来,超云将持续深耕国产全栈AI算力底座,以自主创新与开放生态为双翼,打造覆盖千行百业、适配不同规模的标准化算力方案,加速AI普惠落地,为国内数字产业高质量发展注入持续动能。
