
8月21日至22日,第10届AiDD AI+研发数字峰会在北京举行。本届峰会以"AI引领研发,智创无限可能"为主题,围绕开发、测试、工程、组织与流程、业务与需求五大方向,100余位业界大咖分享、吸引逾千名技术从业者到场。
本届峰会汇集了北京大学讲席教授谢涛、复旦大学计算机学院副院长彭鑫、南京大学智能软件工程实验室主任陈振宇、中国信通院云计算与大数据研究所所长何宝宏等学界与产业界专家。与会嘉宾来自Testin云测、字节跳动TRAE、阿里云、百度、美团、京东科技、华为等企业技术团队,议题横跨AI编码、智能体工程、测试智能化与研发组织重构。
在"基于AI Agent的智能测试实践"专场,Testin云测CEO徐琨分享议题《研发已提速10倍,测试怎么办?——AI重塑研发,测试如何破局》,系统拆解AI编码规模化落地后,质量保障体系面临的结构性挑战与破局路径。

此次Testin云测作为行业引领者受出席在"AI+测试"主场并非偶然。近年来,其AI测试布局密集落子:Testin XAgent智能测试系统在中国信通院"铸基计划"2026年度会议上成为唯一通过官方测评的AI测试产品;Testin 云测与中国信通院、华为等共同编制并发布了国内首个测试智能体标准《面向软件的智能体技术和应用要求 第3部分:测试智能体》;在"2025 AI测试服务商Top 10"榜单中,Testin 云测与Tricentis、Katalon等全球头部服务商共同入选并位居榜首,是唯一的本土厂商。产品研发、标准制定、官方测评,是持续验证Testin云测深耕AI测试行业的有力注脚。就如徐琨在本场演讲中强调:当AI重构研发生产力时,测试不再只是"接住代码"的最后一环,而是决定AI红利能否落地的关键变量,这也是Testin云测持续挖掘价值的方向。
2026年,AI编码工具已从"技术尝鲜"进入规模化落地:83%的开发者已在用AI编码工具,编码效率提升普遍达50%至70%,MIT研究显示AI让代码量增加180%。研发周期被压缩一半以上,代价却集中传导至测试环节:单次提交代码量从500至1000行放大到5000至10000行,发版周期从月度、季度压缩到周度、日度,回归测试占总测试工作量的比例从30%攀升至70%以上。质量风险也在累积:AI代码"看起来对但逻辑错",缺陷密度是人工代码的1.7倍。
"开发效率提升70%、迭代数量翻倍的红利人人可见,而质量波动、漏测、故障与追责的压力,全部压在测试团队身上。"徐琨指出,测试是全链路唯一的"风险过滤器"。行业调研显示,测试执行(尤其是回归)占测试全生命周期工作量的50%至70%,核心系统的回归仍大量靠外包人海战术完成。
面对"用例编写快、脚本转化难、执行跑不通"的行业困境,Testin云测给出的解法是"大模型想、人把关、引擎干"的人机协同路径:大模型负责语义理解、场景分析与脚本生成,人工在关键节点验收校准,Testin云测自研执行引擎负责跨平台稳定执行。这一分工基于对大模型能力边界的判断:概率模型无法承担需要确定性的海量回归执行,Token成本与推理耗时也支撑不起无人全自动运行。Gartner预测,到2028年AI测试占比将超过70%,前提是执行层需要先跑通。
应用落地层面,徐琨细致演示了智能用例转脚本与异常自愈两大能力:用例批量转为自动化脚本,AI脚本采纳率达80%以上,设计效率提升1倍;执行遇弹窗、加载超时、元素变更等异常可自动修复续跑,自愈成功率超80%,脚本维护成本降低50%。技术实现上采用"大模型生成、小模型执行"的分层架构,固化脚本由小模型执行,一套脚本可跨Android、iOS、鸿蒙等多端复用,稳定性超95%,Token消耗降低90%。客户项目中,回归测试时长从5天压缩至1.5天,测试覆盖范围扩大3倍。
面向未来,徐琨提出四个判断:
质量责任前移,开发对AI代码的初次质量负责,测试团队从"质量验证者"转向"质量策略设计者";
质量工程嵌入研发组织,以跨职能团队和共享交付指标取代部门竖井;
测试岗位将分层--策略设计层价值凸显,脚本开发层逐步被AI替代,机械执行层由AI集群接管;
AI个人助手深入工作链,承载更多研发、测试工作,与真机资源池和自动化平台更好融合,进一步放大人机协同的质量提效价值。
"AI不是让测试团队变小,而是让他们去做以前做不到的事。在研发提速成为既成事实的今天,如何让测试接住这10倍速,是所有拥抱AI的研发组织绕不开的命题。"徐琨表示。
当AI编码把研发推入倍速时代,测试智能化已不只是企业的技术选项,而是整个研发生态共同面对的基础设施命题。2026年的AiDD让更多研发组织意识到:AI研发的规模红利,最终要靠质量底座来兑现。而这之间,Testin云测作为AI测试的深耕者会持续陪伴企业伙伴共同探索与发展,推动AI在质效领域释放更大价值。
