7月21日,2026 世界人工智能大会(WAIC) 圆满落幕,声网携对话式 AI 引擎、对话式 AI 开发套件、实时转录翻译等多款 AI 产品亮相本次大会,并重点展示了声网对话式 AI 在智能家居、教育硬件、智能穿戴设备等 AI 硬件领域的落地案例。用一场“可听、可看、可聊、还懂你”的沉浸式互动展位,向行业和观众展示了对话式 AI 技术如何走向商业化落地。
一场“触手可及”的 AI 交互盛宴
在声网展台上,没有枯燥的参数墙,也没有只可远观的产品展示。观众可以随手拿起展台上的硬件设备,亲自开口和它们“聊”上一会儿:
· 具备养成属性口袋 AI 毛绒宠物——芙崽 Fuzozo,会用毛茸茸的身体抖动与萌萌的语音回应你的情绪;
· 拥有多模态感知系统的 AI 宠物机器人——KATA Friends,能“看懂”你的手势并自主走到你面前打个招呼;
· 戴上 HeyCyan AI 眼镜,即刻体验高清拍摄、语音交互与视觉识别的无缝融合;
· 具备全屋移动、AI 对话与双向音视频通话功能的 EBO Air 2 Plus,能随时与家人视频连线,用 AI 和实时监控守护家的安全;
· 专为儿童设计的便携式 AI 学伴——灵宇宙小方机,能通过趣味问答和互动学习,让知识探索变成一场奇妙的冒险……
这些真实可感的互动,让每一位体验者都直观感受到:AI 不再是纯粹一问一答的机械工具,而正在成为能够主动感知、理解并回应你的“智能伙伴”。

声网展台 AI 产品
正如声网在 WAIC 现场接受央视财经采访时所说,人机交互正在从“你说我听”的指令模式,走向“自然对话”的无感模式—— AI 不再需要你适应它,而是它来适应你。
声网业务与战略副总裁陈宝金在采访中表示,客户的核心需求是让智能体与人的交互做到“无感知”。围绕这一目标,声网提供了低延迟响应、智能打断、智能降噪等关键能力,让智能体能够像真人一样理解对话的节奏与意图。你随时可以插话,AI 会即时响应;环境再嘈杂,AI 也只锁定你的声音。这种“无感”体验的背后,是技术对人性化交互的深度理解:真正的智能交互,不是让用户去学习如何与机器对话,而是让机器主动学习人类最自然的交流方式。

央视财经 CCTV-2 到访声网展位
KATA Friends:让 AI “有感知、有温度”
在展出的各类明星产品中,一款集成了声网对话式 AI 能力的新一代智能机器人代表,在展会现场吸引了广泛关注,这便是卧安推出的 AI 宠物机器人 —— KATA Friends ,这是一款可以自主移动的家庭交互机器人,它无需费心喂养,却能够提供真实的情感陪伴与情绪价值。

KATA Friends 配备摄像头、激光雷达、激光传感器和多模态感知系统,基于声网对话式 AI 引擎能力,通过边缘计算驱动的嵌入式大模型实现实时认知,它能感知用户的情绪、视觉识别表情、通过听觉定位解析语音方向、感知触摸动作,并借助三维语义地图构建技术精准自主导航,深度与用户进行互动。简单来说,它会主动走向你、看着你、听懂你,并以最自然的方式与你深度互动——这不再是冷冰冰的指令执行,而是一种有温度的“共处”。
三大核心产品打造对话式 AI 极致体验
极致的互动体验背后,是声网深厚技术实力的支撑。本次展会,声网同步展出了对话式 AI 引擎、对话式 AI 开发套件 R1 & R2 原型机、实时转录翻译三大核心产品:
· 对话式 AI 引擎:声网推出全球首个对话式 AI 引擎,以赋能开发者基于任何大语言模型构建实时语音对话体验。实现 650ms 端到端延时,340ms 极速打断,95% 选择性注意力锁定,打造极致 AI 对话体验。
· 对话式 AI 开发套件 R2 原型机:R2 全场景 AI 机器人开发套件原型机在继承全双工语音优势的基础上,新增了本地视觉识别与多自由度运动控制,能“看懂”手势、识别人脸轨迹,甚至实现“走到你面前打招呼”或“转头注视说话者”这类充满生命感的本能反应 。
· 实时转录翻译:兼顾线上会议、商务沟通等多元场景。支持 150+ 主要语言和方言,中东、东南亚、日韩等主流出海地区小语种覆盖齐全。打破语言障碍,实现实时语音转文字和翻译。就算在嘈杂环境里,也能精准捕捉你的每一句话。
无论是芙崽 Fuzozo 的专属羁绊、HeyCyan 眼镜的即问即答,还是 KATA Friends 的主动靠近——这些体验升级的背后,都集成了声网的对话式 AI 引擎。通过 RTE 与 AI 的深度融合,智能硬件不再是被动应答的工具,而是进化为能够感知环境、理解指令并主动交互的伙伴。原本复杂、高门槛的能力被标准化、模块化,声网正在让不同规模、不同领域的开发者都能快速为自己的硬件产品装上“能听会说”的大脑,为行业铺设一条通往万物智联时代的底层通路,让每一款硬件都能拥有温暖人心的实时智能交互能力。
