芯展速AICC 2026圆满收官 副总裁许玮演讲拆解AI90推理成本新边界

互联网
2026
09/21
18:10
分享
评论

图:芯展速副总裁许玮

9月21日,芯展速AI战略发布会仅3日后,再度携「AI90全新架构 」出席AICC 2026人工智能大会。副总裁许玮受邀在AI芯片论坛发表AI90主题演讲,深度拆解其技术架构和对AI推理成本边界的重新定义,成为多家媒体深度报道与追问的焦点。

展区人气:消费级GPU跑出数据中心级Token产能

展区AI90 Token工厂的亮相,让芯展速成为本次AICC备受关注的参展企业之一。

现场,AI90展示屏幕上跳动的TPS数字让不少来自智算中心、AI应用厂商专业观众停下脚步,与芯展速技术团队深入交流。

专题演讲:AI90 Token 工厂

AICC AI芯片论坛上,芯展速副总裁 - 许玮带来专题演讲,深度拆解AI90边侧推理引擎的技术架构与实测数据。

他介绍:AI90的核心思路是KV Cache 智能调度——将大模型推理中的KV Cache从GPU显存智能卸载到AI SSD,构建HBM+DRAM+AI SSD三级存储智能调度体系。

他强调:实测中,Ai90 的10倍TPS吞吐提升、50倍TTFT首Token响应提升的突出表现,对于智能体、对话机器人等强交互场景,意味着从"卡顿等待"到"实时响应"的质变。

媒体采访:AI90是芯展速「云边端战略的边侧核心

演讲结束后,CSDN记者第一时间找到许玮,就AI90 Token工厂架构及边侧推理落地场景展开深度专访。

(左一)芯展速副总裁许玮 受媒体采访

采访中,许玮从AI90产品技术延伸到芯展速云边端的战略全景——

边侧,AI90 Token工厂降低推理成本,让大模型在边缘节点高效运行;云端,以芯展速全介质存储底座支撑智算中心海量数据集高效读写;端侧,AI SSD加速方案布局,进一步赋能Agent PC与智能终端,让本地推理成为可能。

当算力不再是唯一瓶颈,数据流动的效率正在决定AI的边界。作为AI算力基础设施的重要一环,芯展速将继续以“存—连—管”全栈能力,携手产业伙伴推动存算协同落地,让AI算力在云端、边缘与端侧真正释放。

THE END
广告、内容合作请点击这里 寻求合作
免责声明:本文系转载,版权归原作者所有;旨在传递信息,不代表砍柴网的观点和立场。

相关热点

相关推荐

1
3