让智能不断向上,让技术始终向善|云知声携U-Model家族亮相 WAIC 2026

互联网
2026
07/20
11:41
分享
评论

7月17日至20日,以“智能伙伴,共创未来”为主题的 2026 世界人工智能大会暨人工智能全球治理高级别会议(WAIC 2026)在上海举行。

从70年前“人工智能”概念首次提出,到今天智能技术加速走出数字世界、进入物理世界,人类与人工智能之间的关系正在被重新定义。

这也赋予了WAIC大会主题“智能伙伴,共创未来”更加深刻的时代内涵——真正的智能伙伴,不仅要拥有理解复杂问题、执行复杂任务的能力,也要可靠、可控、值得信赖;不仅要不断突破技术边界,更要始终服务于人的价值。

对于云知声而言,如何让AI真正成为人的智能伙伴,最终落在两条彼此交织的实践路径上:一条是“智能向上”,一条是“智能向善”。在上海世博展览馆H1-D730展位,云知声携以U2为核心的U-Model矩阵与三大Agent集群集中亮相,从模型能力的持续突破,到智能体走进医疗健康、组织流程与日常生活,全方位展示云知声的智能伙伴如何从理解世界、感知需求,进一步走进工作流、与人协同完成任务,以自身实践呼应时代命题:让智能不断向上,也让每一次技术进步,始终向善而行。

智能向上  以U2为核心,持续攀登能力上限   

真正的智能伙伴,要有足够强的理解、感知与执行能力。展会现场,云知声集中展示了以U2为核心的U-Model矩阵。从通用基座大模型,到语音与视觉感知,再到医疗垂直领域的专业模型,云知声持续攀登智能能力与效率的双重上限:一方面,让模型能够理解更复杂的信息、完成更长链路的任务;另一方面,在有限的计算与 Token 成本下提升每一次调用的价值,让更强的智能以更高效、更可负担的方式进入真实场景。

U2:不止“给出答案”,更在于“完成任务”

作为云知声面向个人、开发者与组织打造的原生智能体大模型,U2以高智能密度、高Token价值、原生Agent能力三大核心突破,重新定义了大模型的效率与自主能力。

在复杂办公、软件工程、深度研究与多工具协同场景中,U2能够自主拆解并推进100+步复杂工作流,将需求理解、任务规划、环境交互、工具调用、过程纠错与结果验收串联为完整闭环——从“给出答案”进一步走向“完成任务”。

在全球大模型竞技场上,U2已在多项高难度评测中跻身第一梯队,覆盖长上下文理解(AA-LCR)、知识推理(GPQA Diamond)、指令遵循(IFBench)、智能体执行(SWE-bench Verified)及复杂任务(WildClawBench)等核心维度,其综合表现更是跻身LLM Stats总榜前30,位列全球模型厂商第八,已然开启与头部模型的同台较量。尤为值得一提的是,在公认极具挑战性的长文本理解基准LongBench-V2中,U2以54.4%的Accuracy超越Claude Opus 4.7,充分展现出其对海量信息的持续捕捉与深层推理能力。

多模态大模型矩阵:让AI拥有完整感官能力

复杂任务不仅需要“会思考”,也需要准确感知与表达。围绕听、说、看,U-Model构建起覆盖真实交互入口的多模态感知底座。

● U2-ASR(听觉):不止是语音转文字,更能“听懂”表达。U2-ASR支持上百种方言及多种外语,在复杂嘈杂环境下依然保持90%的识别准确率。在AISHELL-1公开测试集中达99.2%,其方言识别能力全面超越主流ASR模型。

● U2-TTS与Clone(表达):让AI声音更有温度。基于纯因果注意力机制的流匹配模块与神经声码器联合优化,U2-TTS不仅能生成自然流畅的语音,还能精准演绎语气、情绪乃至呼吸与笑声等拟人化细节。配合U2-TTS-Clone的声音克隆能力,仅需5-15秒参考音频即可高保真还原音色,合成自然度与相似度达MOS 4.5+。更支持“音色来自A,情感来自B”的组合式生成及中英文跨语种复刻,能够以极低的成本为数字人、有声内容等注入鲜活个性。

●U1-OCR(视觉):从“识字”进化到“懂文档”。U1-OCR突破传统OCR仅字符识别的局限,实现从“认字”到“懂文档、会提取”的升级。能够精准还原复杂版式(如嵌套表格),智能抽取关键信息,将非结构化文档高效转化为可计算的数据。

医疗双子星:让AI真正读懂“三医”

在专业壁垒极高的医疗领域,U-Model 家族派出了“文本+视觉”的双子星,将大模型直接转化为医疗生产力:

● U2-Med:深度掌握医疗、医保、医药“三医”知识,贯通临床诊疗、基金监管、药事服务全场景。不仅能辅助医生生成规范病历、进行临床决策支持,还能在医保审核、商保理赔等场景中充当“风控专家”——在业务场景实测中,其病历质控达97%、安全伦理达95.5%、诊后与用药管理达94.1%、医保/商保能力达88.8%,综合能力达89.1%,全面超越同级别主流大模型。

● U1-OCR-Med:专为医疗文书打造。面对手写潦草的病历、印章遮挡的处方或复杂的检查报告,U1-OCR-Med能实现像素级定位与精准抽取,可有效解决医疗数据录入中最头疼的“脏数据”难题,更让U2-Med的分析有据可依。

智能向善  让Agent进入工作流,服务每一个真实需求

对云知声而言,“智能向善”不是为技术附加一层温情叙事,而是让AI始终以人为中心。真正的智能伙伴,不是取代人,而是在专业场景中辅助人、在复杂流程中协同人;既要做到可靠、可控、可追溯,也要让先进能力以可负担的方式服务更多组织与个体。

此次WAIC,云知声围绕医疗健康、组织流程与智能交互,集中呈现医疗专家、数字员工与数字助理三大Agent集群。它们不再停留在单轮问答与功能演示中,而是进入工作流,与人协同完成复杂任务,把模型能力转化为可执行、可验证、可交付的成果。

医疗专家Agent 丨贯通三医,守护每一份健康

在专业壁垒极高、容错率极低的医疗场景中,医生长期被病历录入与合规审查所困——大量时间耗费在键盘敲击与事后补写上,传统的人工抽检质控滞后且覆盖面有限,诊疗时间被挤占,合规风险却在累积。

医疗专家Agent深度融入诊前、诊中、诊后全流程,可实时采集医患对话、自动生成规范病历,将医生从键盘前解放出来;对病历完整性、逻辑性与合规性进行实时校验,推动质控从“事后追责”向“事中预警”转变;贯通医保智能审核与药品耗材价格合规审查,让“三医”风险管控融入每一个业务环节——让医生回归诊疗本身,将合规交给AI。

数字员工Agent|流程自动奔跑,员工回归创造

在企业组织中,大量业务执行人员常年充当“系统搬运工”——工单处置、公文流转、费用报销、合同风控等高频任务散落在多个互不相通的系统中,跨平台切换、手动复制粘贴占据了大量时间,人为差错与合规盲点也难以避免。

云知声数字员工Agent覆盖政务工单处置、多语种客服、公文收办与档案分拣、费用报销与合同风控、医保价格稽核、表单标准化与智慧营销等场景,可将跨岗位、跨系统的机械操作编排为自动执行的标准化工作流。技术的价值不只是让流程跑得更快,更是让员工从重复劳动中抽身,把时间留给判断、沟通与创造。

数字助理Agent:懂办公,更懂生活

在政企与企业的日常办公中,最耗时的往往不是“写字”,而是“找字”与“理字”——起草公文、审核合同、编写纪要,每一项任务背后都是大量资料查阅、政策理解与逻辑梳理的拉锯战。而在车载等生活场景中,交互的繁琐同样让人疲惫——触控操作分散驾驶注意力,语音指令频频中断,智能座舱既不“智能”也不“体贴”。

云知声数字助理Agent覆盖公文撰写与审核、会议纪要、合同起草、招标造价预测、行政知识问答等高频办公场景,能够自动完成“查找资料—理解背景—匹配规范—梳理逻辑—生成成果”的完整闭环,让办公不再是信息的苦役。进入座舱场景,车载Agent能通过自然、连续的多模态交互,帮助驾驶者完成导航、影音娱乐、车辆控制与资讯查询等高频操作。技术不再要求人反复适应系统,而是让系统以更自然的方式服务于人。

从模型能力的持续突破,到三大Agent集群进入真实工作流,WAIC 2026所呈现的,不仅是云知声让AI从“理解问题”走向“完成任务”的阶段性成果,更是其对“智能向上、智能向善”的持续践行,也是对大会主题“智能伙伴,共创未来”的具体回应——以技术突破不断抬升智能伙伴的能力上限,以场景落地让AI真正走到人身边、进入工作流,与产业、组织和个体共同创造价值。

智能的进化仍在继续。接下来,云知声将在语音技术领域迎来两项重磅升级——新一代 U2-ASR 与 U2-TTS 即将发布——

一个负责“听懂”更多语言。新一代 U2-ASR 将重点升级外语识别与转写能力,进一步拓展可识别的语言范围,让更多外语能够被准确理解并转化为文字。

一个负责“说出”更多语言。新一代 U2-TTS 将升级多语种语音合成能力,支持更多外语自然表达,让 AI 能够以不同语言生成流畅、真实的语音,进一步降低跨语言沟通与内容生产的门槛。

从听懂每一种表达,到自然说出每一种语言,U2-ASR 与 U2-TTS 将共同拓展 AI 感知世界、连接人的能力边界,为智能体进入更多真实场景构建更加自然、高效的交互入口。敬请期待。

THE END
广告、内容合作请点击这里 寻求合作
免责声明:本文系转载,版权归原作者所有;旨在传递信息,不代表砍柴网的观点和立场。

相关热点

相关推荐

1
3