2026年世界人工智能大会上,讯飞AI眼镜被选为大会“镇馆之宝”之一。这款整机仅40克±5%的AI眼镜,支持122种语言(含口音)实时翻译,翻译字幕可直接投射于镜片。从5月底澳门BEYOND Expo的正式发布到在世界人工智能大会上的亮相,讯飞AI眼镜的每一步都在验证同一个命题:AI从数字世界走向物理世界,需要一个“能听会说、能看会认”的超拟人多模态交互系统去承载——而眼镜,正是这一系统最自然的穿戴形态。这一判断背后,是讯飞二十年技术长跑的底气。

从“能听会说”到“能看会思考”
二十余年里,讯飞拥有强大的“听”的能力:嘈杂环境下锁定人声、多人对话中分离音轨、专业术语精准翻译,但讯飞对AI终局的判断不止于此。“能听会说”解决的是信息输入与输出,而“能看会思考”解决的是对世界的理解与交互。
在讯飞AI眼镜上,语音技术的积累完成了三重进化:一是通过唇动识别融合降噪算法,从“听到”升级为“锁定”发言者;二是GlassClaw超级助理在翻译同时自动抓取关键参数、争议点,一键生成结构化纪要,从“翻译”升级为“理解”;三是依托星火X2大模型主动提取信息、生成方案、分发邮件,从“被动响应”升级为“主动服务”。二十余年语音深耕让讯飞拥有业内最懂“声音”的AI,而AI眼镜则让这个AI第一次拥有了“眼睛”和“视野”——将听觉精度、翻译深度、降噪强度,全部投射到全新的感知维度上。
这,也是讯飞AI眼镜不可复制的底层逻辑。

三大核心能力,定义AI眼镜价值边界
讯飞AI眼镜并非将技术简单塞进镜架,而是围绕真实场景痛点,完成了从“功能堆砌”到“任务交付”的能力跃迁。
全场景翻译,支持122种语言实时翻译,覆盖旁听同传、面对面翻译、线上同传与通话翻译四大语音模式,配合摄像头视觉翻译,图文标识实时译。更关键的是,讯飞首创唇动识别多模态降噪方案——通过前置摄像头捕捉唇部动作,在嘈杂展会、酒会环境中精准锁定发言人,实现“看谁就翻译谁”。
GlassClaw超级AI助理则让眼镜从翻译工具进化为“随身AI智慧体”。它能自动抓取会议关键参数与争议点,会后一键生成结构化会议纪要并推送邮箱。从信息采集、记录生成到邮件分发,GlassClaw独立完成全流程闭环,真正实现从“听懂一句话”到“完成一项任务”的质变。
技术再强,若佩戴负担过重,便失去了“随身穿戴”的资格。讯飞AI眼镜以40克±5%的超轻机身则回答了AI硬件最朴素的追问:用户为什么愿意每天佩戴?讯飞通过材料选型、光学模组、结构设计与元器件集成四大环节同步优化,打造出全球最轻的双目显示多模态AI眼镜,较同类产品轻约20%。
二十余年长跑的必然落点
讯飞AI眼镜的诞生,不是对“百镜大战”的跟风回应,而是科大讯飞二十年技术积累在穿戴形态上的集中释放。从语音合成、识别、翻译到多模态交互,每一项能力都经过真实场景千锤百炼。
在这场从“技术仓库”到“随身穿戴”的跃迁中,讯飞给出的答案是一副让AI脱离屏幕、融入视野的眼镜。它让AI不再是需要用户主动“打开”的窗口,而是成为用户“看见”的世界。
讯飞AI眼镜,正是这一演进的最佳注脚。
