MTSC2026深圳大会以 “质效革
全天精彩呈现

lm体育app正式成为AC米兰官方合作伙伴 - lm体育app

2026年08月15日 - 08月15日
广东省深圳 · 3Garden三角花园
¥1800 起

会议介绍

MTSC2026深圳大会以 “质效革新·智领未来” 为主题,全天精彩呈现,采取“6个平行专场”的形式。大会设沐瞳专场、AI组织转型、TME专场、Agent驱动的测试执行体系、AI时代的质量治理与可信评测、AI原生应用测试与行业落地6大专场。例如
活动期间,来自国内外的顶尖技术专家、行业领袖、企业高层将围绕AI+软件测试领域的最前沿技术、行业热点话题、最佳实践经验以及未来发展趋势展开深入讨论。

专场介绍:

  • AI组织转型——破解团队发展困局:聚焦AI时代测试团队转型与人才梯队建设,从管理与个体双视角,提供可落地的转型思路,实现组织与个体协同进化。
  • Agent驱动的测试执行体系:探索AI Agent在测试全环节的应用,打破传统自动化瓶颈,助力测试团队降本增效、实现智能化升级。
  • 沐瞳专场——游戏测试实战拆解:依托沐瞳科技游戏领域积淀,拆解游戏场景AI测试落地经验,破解游戏测试复杂难题,助力从业者提升核心竞争力。
  • AI时代的质量治理与可信评测:聚焦AI产品质量管控,探讨数据集评估、模型可信性评测等核心议题,助力企业筑牢AI产品质量防线。总体而言
  • AI原生应用测试与行业落地:覆盖智能体、RAG等AI原生产品测试,分享多行业实战案例,打通技术落地“最后一公里”。
  • TME专场——音视频测试前沿实践:结合TME技术优势,分享音视频测试核心难点解决方案与规模化落地经验,适配AI时代音视频产业发展需求。

大会面向:测试工程师、研发工程师、测试经理、研发经理、测试总监、研发总监架构师、CTO等行业人士,“落地、务实、有深度”的内容风格和良好口碑,取得测试开发者、互联网一线企业及全行业的认可和大力支持。

MTSC2026深圳大会,不仅是一场技术盛宴,更是一次与行业精英共聚,让我们以技术之名在AI驱动质量革命的浪潮中,共同探讨行业发展的未来契机。共同见证行业的发展生态之变

我们诚邀您,8月,共聚深圳!


【会议日程】

2026-08-15

09:00-12:30

AI原生应用测试与行业落地

国际厅1

09:00-09:50

意图驱动测试在 AI 记忆产品中的落地:契约、语料与可继承的质量知识

做 AI 记忆,链路很长:话怎么说进去、怎么存、怎么搜出来、最后怎么回到用户身上。AI
记忆类产品难测,难在整条链路是意图理解→写入→检索→个性化响应,传统自动化容易退化成堆 URL
而不是靠人肉对文档。工程上坚持上下文进前置、业务动作全显式,避免把创建/搜索藏进前置里,和参数,分不清是契约变了还是业务错了。我们的做法是意图驱动:用例先写清业务意图想验证什么,和用户到底想达成什么脱节;接口调整后,用例报错,代码只负责串起来和断言;同时把接口文档当作契约,在成功响应后自动做结构级对比,让契约漂移在集成阶段就暴露,数据放进独立语料,再把能复用的动作沉淀成步骤库。排障时无从追溯。覆盖上用特性矩阵
+
改进计划把缺口写成可跟进的项(例如搜索隔离、负向路径)。落地后自动化规模可观,手工留一条端到端链,补自动化够不着的场景。文档和经验以前跟着人和会话走,现在用记忆系统把「怎么测、出过什么坑、业务数据」都留下来,后面的人不用从头问。并用量化的效率与一致性指标(如对话轮数、AI检测)看飞轮是否在转。

听众收益:

1.一套交付闭环的完整拆解:从 Diff 分析到意图测试、到 AI 出回归建议人做 check、到 AI 定位 Bug 到 QA 直接改代码验证——每一步怎么做、边界在哪、踩过什么坑,会讲得很具体,我们团队现在就是这么在实践的,不是方法论是每天在跑的流程。

2.契约左移 + AI 辅助回归的可操作做法:文档变契约 + 自动对结构 + 合并门禁,找一个接口就能在自己团队试。集成回归怎么让 AI 出草稿、人怎么 3 分钟挑重点删废话,带团队的人可以直接参考。

3.AI 辅助的真实边界:AI不是万能,会讲清楚 AI 生成用例、定位 Bug、给修复方案各自靠谱和不靠谱的场景。以及用什么机制(门禁、矩阵、人工 review)兜住 AI 不靠谱的部分。

贾澄臻

记忆张量 测试负责人

09:50-10:40

AI驱动的搜索质量智能化实践

随着生成式 AI 与搜索引擎的深度融合(RAG 模式),传统的“输入-预期输出-断言”质量保障体系彻底失效。面对生成结果的不确定性、高频策略迭代、以及跨越“召回-知识库-排序-生成”的超长排查链路,人工抽检与专家定位的 ROI 持续走低。

本次分享主要聚焦我们在 AI 搜索质量保障领域的创新实践——“感知-评测-诊断-治理”一体化 AI4T 体系。

我们通过“全场景巡检”主动捕获线上时效、事实性偏差等异常;构建“规则+LLM双驱动”的多维自动化评测标准提效大规模效果评测;并自研“搜索质量
Agent”,利用 CoT 与策略分类器,将专家排查经验转化为可调用的多源工具链,实现高跳词与 badcase 的分钟级自动归因

本主题分享AI技术在搜索业务质量的应用,并深入剖析在标准制定、推理路径收敛、可取证性设计等方面的真实“踩坑”教训。为同行建设大模型应用质量体系提供一条高可行性的落地路径。

听众收益

1. 理解范式转变:掌握大模型/RAG 架构下,从“断言校验”向“语义对齐与风险分布监控”转变的质量保障新思路;

2. 获取可落地架构:带走一套包含“线上巡检、多维自动打分、智能诊断 Agent”的三位一体 AI4T 技术架构;

3. 避坑与实战经验:学习如何解决“大模型打分不稳定”、“Agent 推理发散”、“数据不可取证”等踩坑经验;

4. 效能跃升路径:了解如何单次评测耗时缩短 提效。并实现分钟级 badcase 自动归因定位。

曹旭

虎鲸文娱 技术专家

10:40-10:50

休息

10:50-11:40

打破黑盒:华为Agentic AI智能应用可靠性测试实践

随着Agentic AI智能体应用的快速发展,传统软件测试与可靠性评估方法正面临系统性失效:测试对象从“确定性代码”演变为“概率性智能行为”,系统边界从“封闭逻辑”扩展为“开放环境交互”,评估目标也从“功能正确性”转向“行为可信度”。

在实际AI业务测试过程中,如何评估智能体行为是否可靠、可控与可解释。例如:

AI系统天然黑盒,如何构造“故障模式”,实现可控执行策略路由?

敏感数据受限,测试样本稀缺,如何规模化构建评测扰动数据?

如何庖丁解牛,评估感知决策可靠性、工具调用执行可靠性、记忆与反思可靠性?

Agent行为具备非确定性,如何定义“正确”与“稳定”?

本议题将围绕Agent应用可靠性测试的范式转变展开。介绍华为AI测试团队在这些方面探索和当前取得的初步效果

听众收益:

适合如下角色从业者,了解 AI系统可靠性测试中遇到的难题以及从我们团队的解决方案中获取一些启示。

AI应用开发工程师 / Agent开发者

软件测试与质量工程团队

AI平台与基础设施团队

技术负责人 / 架构师

陈永健

华为技术有限公司 Agent测试总工

11:40-12:30

AI Native 测试工程实践:用知识图谱与大模型重构仓储机器人调度系统的端到端测试工作流

仓储机器人调度系统(RMS)是典型的复杂实时系统:多产品线并行、业务链路深、异步回调多、设计文档分散——这让测试工作天然面临知识获取慢、用例转脚本难、失败根因难定位三大瓶颈。总的来说

本议题分享一个测试团队在
再以 11 个11 个工作日内从零构建 AI Native 测试工程的完整实践。核心思路是将 1681 篇设计文档结构化为知识图谱,
Claude Code Skill覆盖测试全生命周期节点,最终串联成一条从 Jira 需求到测试报告的一键式自动化流水线。

不同于"用 AI 写几个测试脚本"的浅层实践,本工程探索的是:如何用工程化方法把 AI 能力嵌入测试研发流程的每一个节点

,让团队成员在不具备框架开发能力的情况下,也能通过 AI协作产出可持续运行的自动化测试。事实上截至分享时,主干已有 98 个持续可运行的测试方法,覆盖 5 条产品线,4 名团队成员在 11 个分支上并行协作。

听众收益:

一套可复用的 AI 测试工程分层模型

知识库层 / AI Skill 层 / 自动化执行层的三层架构,以及各层之间的边界划分原则——可直接对照自己团队的现状做映射。

汪磊磊

北京极智嘉科技股份有限公司 系统平台部 资深测试开发专家

14:00-18:30

Agent驱动的测试执行体系

国际厅1

14:00-14:50

从人工保障到平台化工程:HKGAI 大模型测评体系的自动化跃迁

在我们的 AI 大模型与 Agent 业务测试中,最核心的一项工作是高效、准确定量地评估大模型的实际能力与业务表现,但面临着以下严峻挑战:

(1) 评测效率与一致性面临巨大瓶颈:大模型高频迭代,但传统人工测评存在标准不一、主观性强且耗时长(如100条用例需3人/天)的问题,如何突破人力吞吐上限,实现万级用例的高效自动化评测?

(2) 评测基准脱离真实业务场景:实验室构建的静态测试集往往过于理想化和陈旧,难以覆盖真实世界中复杂、长尾的交互逻辑(如多轮偏航、提示注入等),如何打破“实验室高分,线上拉胯”的魔咒?

(3) 高质量专有数据极度匮乏且高度敏感:垂直领域微调与测评所需的高质量数据稀缺,且政企知识文档高度敏感、格式复杂(含复杂PDF、表格等),如何在保障隐私安全(数据不出域)的前提下大规模扩充测试样本?

(4)数据清洗与标注成本极其高昂:传统数据集制作高度依赖人工“作坊式”的分段、提问与校对,效率低且无法量产,如何利用AI大模型自身的能力和工程化手段,实现非结构化文档到高质量数据的自动化提纯?
本次分享将介绍 HKGAI 测试团队在这几个方面的探索,重点剖析如何构建大模型自动化测评平台与企业级数据集生成系统(数据炼油厂),以及当前取得的测评交付提速16倍、数据集构建成本降低92%的初步落地效果

听从收益:

(1) 突破大模型评测的效率与规模瓶颈: 了解人工测评面临的一致性与吞吐量局限,学习如何从0到1构建高并发的大模型自动化测评平台。获取将交付周期提速16倍以上、支持万级用例回归的工程化实践启示。

(2) 破解高质量AI测试/微调样本的“数据荒”: 了解在数据隐私合规限制下专有样本匮乏的痛点,获取利用AI“数据蒸馏”流水线(多模态解析+自动提问生成)将企业文档低成本、分钟级转化为高质量数据集的实战解法。

(3) 解决“实验室高分,线上拉胯”的体验脱节: 了解静态测试集难以覆盖真实世界复杂长尾交互的局限,从我们引入“众测系统(无人侦察机)”和“生产环境脱敏数据回流”的方案中,获取如何规模化捕获未知缺陷的启示。

(4) 获取测试团队转型的架构演进思路: 了解如何跳出单一的“人工质量保障”思维,从我们构建“评测-缺陷-数据沉淀”自我强化飞轮的历程中,获取打造数据驱动的“AI质量基础设施”的全局视野。

郭振华

香港生产式人工智能 测试负责人

14:50-15:40

货拉拉 UI 自动化新范式:从人工驱动线性到 AI 驱动闭环

在「多端兼容 + 品牌碎片 + 周级迭代」的极端场景下,如何打破传统自动化「高维护、低鲁棒、难扩展」的困境,构建从生成到自愈的全链路闭环?

【五大痛点直击】

维护崩塌:1.8w+ 脚本规模遭遇单周迭代冲击,线性维护成本不可持续;

弹窗黑盒:权限/合规/厂商定制弹窗碎片化,传统规则引擎泛化能力弱,中断率高;

定位脆弱:ID/文本强依赖导致文案/布局微调即失效,缺乏「生成校准+执行自愈」双重保障;

诊断低效:失败根因依赖人工经验,链路长、定位慢,修复效率瓶颈明显;

资产沉淀难:新业务脚本仍依赖人工编写/录制,无法实现自动化资产的快速复用与沉淀。

【解决方案:AI 驱动的全链路闭环】

本次分享将揭秘货拉拉质量团队在 「生成 → 执行 → 自愈 → 迭代」 闭环中的创新实践:

生成侧突破:聚焦步骤降噪、DOM 语义定位与视觉模型辅助,基于 AI 执行轨迹自动生成高质量 DSL,从源头提升脚本的语义理解力与初始健壮性;

执行侧感知:构建「截图+OCR+DOM+控件画像」的多模态融合感知体系,重点分享弹窗智能处理、文本语义比对及元素重定位的落地细节,以及约束大模型泛化的工程技巧。解决碎片化识别难题;

自愈侧决策:创新「控件画像 + 五步分层诊断」体系,通过结构化决策输出实现步骤级精准重试,让自愈过程可解释、可追踪,可进化。

胡嘉椿

货拉拉 质量保障部 资深测试工程师

10:40-10:50

休息

16:00-16:50

测试效能的范式转移:从AI辅助写脚本到结构化知识驱动脚本生成

AI编程工具的爆发式增长,让代码生成效率提升了10倍以上,但测试环节的滞后正成为新的效能瓶颈。传统“开发-测试”串行的交付范式已无法适应AI时代的节奏。本议题将分享我们如何构建一套从需求端到交付端的全流程AI驱动效能体系。我们不仅实现了基于业务需求自动生成代码、测试用例与脚本,更设计了一个约束型测试框架,防止AI过度发散。通过从代码中提取关键信息进行缺陷分析与用例补全,并建立自动触发-发现缺陷-修改缺陷-自动验证的闭环机制,我们成功将测试从“瓶颈”转变为效能加速器,实现端到端的真正提效

听众收益:

- **了解一种全新的端到端效能提升范式**:学习如何将AI能力从“单点辅助”升级为“全流程协同”,突破开发与测试之间的效能断层。

- **掌握约束AI过度发散的测试框架设计思路**:获取如何通过框架设计控制AI输出质量。避免生成冗余或无效内容的实践经验。

- **获得从代码逆向提取信息、反哺测试与需求的实操方法**:学习如何利用AI挖掘代码中的深层信息。实现缺陷的提前识别与需求的精准补全。

- **学习构建自动化质量闭环的落地路径**:理解如何打通代码提交、缺陷发现、自动修复与验证的完整链路。为团队引入高效的AI驱动研发流程提供参考。

李雁翎

微众银行 AI测试架构师

16:50-17:40

基于RAG架构的证券业测试用例自动生成实践

证券业务因其高复杂性与严合规性,在测试工作中面临着

(1)业务复杂度高,人工覆盖难

(2)回归测试繁重,效率瓶颈凸显

(3)数据合规敏感等难点、

听众收益:

了解AI在传统金融行业测试中遇到的难题及我们团队实际解决方案及解决方案中落地的难点与解决思路

胡利民

湘财证券股份有限公司 系统支持部 测试工程师

17:40-18:30

SoloPi-AI:移动端研发跑通 AI Harness 全托管的最后一环

当 CodingAgent已经能够理解需求、修改代码并完成构建。移动研发最后的断点仍发生在代码离开仓库之后:应用安装、真机操作、状态观察和结果判定依然高度依赖人工。权限、系统弹窗、跨应用交互与
OEM 差异,让单一自动化通道难以稳定覆盖;截图、UI Tree、Logcat 和性能数据彼此割裂。也让 Agent 难以对真实运行结果负责。

本课题,将分享
SoloPi-AI 在移动研发场景中的落地实践。团队将传统 SoloPi 的确定性自动化与大模型的理解、规划能力深度融合,把真机封装为可被手机端、桌面 Coding Agent 统一调用,构建“理解任务 → 控制真机 → 融合证据 → 智能判定 → 失败反馈”的端到端闭环。通过 Accessibility、ADB、Shell 多通道执行,Skill等协议,以及用例生成、稳定回放和多源证据判定,推动移动研发从“脚本即代码”走向“Agent 即质量合伙人”,让 AI 从生成代码进一步走向对真实运行结果负责。

听众收益:

● 理解 GUI-Agent 视觉测试的技术原理及与传统 UI 自动的本质差异

● 掌握 AI Agent 编排在质量保障场景的架构设计方法论

● 获得金融级 IoT 支付场景下智能质效体系的落地参考

余亮(太玄)

蚂蚁集团 技术专家

09:00-12:30

AI时代的质量治理与可信评测

国际厅2

09:00-09:50

TEKO AI移动端多端一致自动化新实践

在我们的 AI 移动测试实践中,最核心的一项工作是将大模型驱动的 UI 自动化能力真正落地到手淘 androids、ioses、鸿蒙多端复杂业务场景中。但面临的挑战有:

(1) 多端技术栈异构,如何实现“一份自然语言用例,三端一致执行”?

(2) 长流程易遗忘、模型输出易幻觉,如何构建稳定可控的 AI 执行闭环?

(3) 纯 AI 推理耗时高、业务知识注入粗放,如何兼顾智能泛化与工程执行效率?

(4) 断言维度单一、优化依赖经验试错,如何实现全链路质量验证与迭代可归因?

本次分享将介绍我们团队在AI驱动的移动端多端一致自动化的核心实践,以及在这几个挑战上的探索与落地成效。

听众收益:

了解大模型在移动端测试落地中遇到的核心难题,以及从我们团队的 Agent 工程化实践中获取一些兼顾“智能泛化”与“工程可控”的可复用启示。

杨日东

淘宝 淘天集团业务技术终端平台 测试开发工程师

09:50-10:40

重塑 AI 原生视频质量防线——基于分层混合架构的视频内容检测方案

随着 AI 视频生成技术步入工业化落地阶段,传统的软件测试与纯端到端的大模型评估体系正面临前所未有的挑战:不仅存在掩盖致命语义错误的“高分补偿陷阱”。还面临大模型调用成本极高、响应时延过长以及规则难以维护的“不可能三角”。

- 核心定位:本议题针对 AI 视频生成(AI原生视频)场景,提出一套“漏斗式分层混合检测架构”。

- 架构特色:通过三层递进式过滤(基础画质拦截 → 多维特征门控 → 大模型深度仲裁),结合意图路由与特殊场景专用链路系统性解决语义偏差、属性错配等核心质量问题。

听众收益:

- 方案升级:破解 AI 视频评测的“不可能三角” 深入剖析传统加权打分机制在 AI 视频场景下的失效原因(揭秘“高分补偿陷阱”),理解纯端到端多模态大模型在成本、时延与幻觉上的工业化局限,掌握 AI 原生视频内容质量保障的全新破局思路。

- 架构解析:掌握“漏斗式分层混合架构”的设计精髓 学习如何设计一套兼顾低成本与高并发的混合检测架构。掌握意图复杂度路由(Complexity
Router)的分发逻辑,以及 L1(基础画质)、L2(多维特征与槽位门控)、L3(大模型深度仲裁)三层漏斗的递进式拦截策略。

- 技术实战:核心痛点攻坚与特殊场景应对策略 了解如何利用 NLP 语义槽位拆解与 Hard Gate(一票否决)机制实现 100% 确定性的致命缺陷拦截;学习针对多镜头强叙事、电商 ID 强保真、带字视频 OCR 等高难边界场景的专用插件化检测方案。

- 工程落地:构建高敏捷、低成本的动态治理体系 获取将算法策略转化为工程化交付的实战经验,学习如何通过 Rule DSL(YAML 动态配置)将检测标准外置,实现无需研发发版即可实时生效的业务自助化迭代,大幅降低系统的长期维护成本。

焦海棠

岩山科技-二三四五网科 高级测试工程师

10:40-10:50

休息

10:50-11:40

从多维感知到智能归因:AI Agent 在业务刻画与异常诊断中的实践

在蚂蚁数字支付场景架构日益复杂、数据爆发式增长的背景下,传统的人工分析正面临效率低下、链路断裂及专家经验难以传承的挑战。“Agent智能归因诊断分析系统”,深度融合了大语言模型逻辑推理能力与智能算法的下一代决策平台。系统核心构建了一个具备“自主规划、工具调用、深度推理、归因分析”能力的AI智能体。当业务指标出现异常波动时,Agent能像资深专家一样,自动跨越系统孤岛,实时调用SQL、日志分析及因果模型进行多维下钻。

它不仅能精准定位问题的技术根因,还能将碎片化的数据串联为端到端的业务动线,生成技术业务都能看懂的可视化分析报告,实现从“看到波动”到“理解原因”的飞跃。有效打通了业务增长与技术保障之间的“最后一公里”。通过持续沉淀组织经验,助力质量同学从被动救火转向主动洞察,实现更高维度的数智化决策与运营范式

李松

蚂蚁集团 数字支付技术部 高级测试开发工程师

11:40-12:30

基于LLM+SKILL+MCP的APP全链路性能测试

在Shopee App的性能测试中,我们长期面临三座大山:

时间成本高:脚本编写、环境配置、数据解析等“准备和善后”工作占用了工程师超80%的时间。

维护地狱:12个国家、多个APP版本、频繁的ABTest,让UI元素定位和脚本适配的维护工作量呈指数级增长。

人才困境:工具链(Poco/Airtest/Python)复杂,新人上手难,能力难以规模化复制。

这些“高重复、有规则、可描述”的工作,恰恰是AI最擅长的。本次分享将介绍我们如何放弃“用AI替代整个测试流程”的幻想,转而采用一种更务实的方案:用
LLM(大脑)理解需求、用 SKILL(知识库)注入硬约束、用
MCP(手脚)封装并调度基建能力。通过这个“铁三角”,我们将脚本编写、元素维护、任务调度等环节全面AI化,最终实现端到端测试效率提升约80%,将核心测试耗时从“人天级”缩短至“小时级”。

听众收益:

获得一套可复用的方法论:理解“LLM+SKILL+MCP”铁三角架构的设计思想,掌握如何将AI与现有测试基建无缝缝合,避免重复造轮子。

洞见效率跃升的关键路径:通过自动化脚本生成、视觉UI维护、对话式调度等实战案例,看清如何将测试中“高重复、可描述”的环节逐步交给AI。把人力解放到更有价值的工作上。

启发测试体系演进方向:共同探讨如何让性能测试从“事后专项”向CI常态化校验演进,最终实现性能“左移”。

郑惠芬

Shopee APP测试开发工程师

09:00-12:30

智能化游戏测试

国际厅2

14:00-14:50

Harness Engineering: 一个基于AI Agent的游戏服务器性能压测与治理方案

实现压测全流程智能体化(Agentic),提高覆盖率降低人的成本

听众收益:

了解AI Agent驱动的性能工程新范式,面对“多产品矩阵、高频迭代、千万级并发”复合挑战时的技术解法,学习如何利用智能闭环攻克脚本构建冗长与数据感知滞后的现实痛点,实现效能的量级提升。

陈曦明

腾讯 腾讯IEG游戏服务器性能测试团队负责人

14:50-15:40

MLBB性能质量保障

本次分享会介绍
Agent 在 MLBB 性能质量保障中的实践:如何让 Agent
进入业务流程,并把运行过程中产生的信息整理成可分析的材料。重点不是一次性完成一个任务,承担任务执行和数据收集,而是让 Agent
承接一套持续推进业务内容的循环:每一次触发都会推动运行和分析,每一次上报又会带来新的状态、复测或下一轮任务。

其中一个重点是游戏场景下的探索执行:Agent不只是调用固定脚本,而是能够根据游戏画面和当前状态完成下一步操作。随着执行次数增加,系统会逐步构建可复用的游戏状态和操作经验,让后续任务更快判断当前处在什么状态、下一步应该做什么;后续分析也会结合已有经验和新的运行结果形成判断,并把问题反馈到上报和持续验证中。

听众收益:

了解 Agent 如何进入性能测试业务流程,而不是只完成单个自动化动作。

理解游戏场景下具备一定泛化能力的探索执行如何落地。

理解 Agent 如何逐步构建游戏状态和动作关系,让后续任务更快找到当前状态和下一步动作。

了解运行结果如何进入分析、问题上报和持续验证。

吴展吉

沐瞳科技 性能测试高级工程师

15:40-16:00

休息

16:00-16:50

AI技术在MOBA游戏中的实战分享

随着大模型(LLM)与 Agent 技术的爆发,AI 在测试工程领域的应用成为行业焦点。然而,在面对千万级高并发、具有严苛实时一致性要求的超级 DAU 项目(如MLBB)时,传统测试手段往往面临着研发需求应接不暇、机制组合爆炸、以及线上线下高强度工作内容并行等多重极限挑战。脱离了工程基建谈 AI,大模型往往只能停留在“聊天机器人”的阶段。

本次分享将结合沐瞳 MLBB 项目的真实高压业务场景,详细介绍团队如何打破历史 ROI 的“不可能三角”,将大模型技术深度融入工业级质量保障流水线中。实际上

本次分享将重点探讨:

(1)底层风控预审:如何通过 AI 结合 AST(抽象语法树)解析。实现海量底层配置与代码的分钟级自动化风险阻断?

(2)多模态战术研判:如何剥离执行层与认知层,利用“云端并发+大模型视觉与行为树日志”,完成 130+ 英雄防挂机/防送头的自动化战术研判?

(3)主观资产量化:如何构建 Agent Runtime 测试中枢,将极具主观性的美术特效、UI 与渲染资源转化为硬性的性能门禁? 此外,也将坦诚复盘团队在落地 AI 过程中遭遇的“模型幻觉”、“样本污染”等痛点,探讨新时代下质量保障体系的重构方向。总的来说

听众收益:

架构选型与解耦思路:了解如何将大模型与传统 CI/CD 流水线深度解耦(工具执行 + AI主判 + 人工校准),获取大型项目引入 AI 的正确排兵布阵方法。

硬核落地案例参考:获取 AI 在底层代码风控、多模态对局异常研判、非结构化美术资产检测等复杂业务深水区的一线落地经验与可量化数据。

职业转型的破局启发:从实战角度剖析大模型带来的风险防范 SOP,探讨 QA 工程师如何告别 AI 焦虑,向复合型质量架构师、AI 能力校准师向上升维。

文琦

沐瞳科技 MLBB 测试经理

16:50-17:40

AI-Native 驱动下游戏测试组织的进化初步探索与思考

叶均杰

网易游戏 网易互娱 游戏测试专家

17:40-18:30

QA Agent数字员工协同平台

本次分享互娱QA自主研发的AI数字员工协同平台,旨在为Agent提供全生命周期管理,构建测试体系的智能化流程,实现从个人提效到组织提效的转变。因此平台提供了Agent构建调试、流程编排、智能调度、运行管控以及设备基座等能力,通过打造一体化协同底座,让每一位QA都可以打造属于自己的数字员工。

余泽希

网易游戏 资深工具研发专家

王建军

网易游戏 工具研发专家

09:00-12:30

TME智能化专场

深圳厅

09:00-09:40

重构研发效率:AICoding研效体系搭建与迭代之路

AIGC时代软件研发向智能化跃迁,但企业落地仍面临私域知识壁垒、工具链路割裂及效能难以量化等痛点。本分享结合腾讯音乐(TME)的深度实践,系统分享企业级 AICoding 研发基建与落地经验。

我们将重点解析TME如何构建融合私域知识的 AI Coding 助手与 Agent 统一管理中枢;AI 在核心研发链路的实战落地;并首度揭秘 TME 破解“提效黑盒”的 AI 效能度量体系。


听众收益:

(1)获得企业级 AI Coding 基建的完整蓝图

(2)掌握 AI 在真实研发链路中的深度落地方法

(3)构建可量化的 AI 效能度量体系

李娟

腾讯音乐 QQ音乐研发效能中心资深测试开发专家

09:40-10:30

代码质量自我进化:AICR驱动全自动审查闭环新模式

AI Coding大幅提升效率,但代码质量风险也随之激增。本分享将回顾AICR从0到1的真实演进路线。构建既懂业务又低成本的代码审查体系。

(1) 如何让AI审查理解需求、项目意图且减少变更Diff理解幻觉?

(2) 如何做到“审查看Diff,追踪看Commit”,低成本防止修旧引新?

(3) 如何通过多Agent的收拢与扩展,让审查建议少而精、精而全,驱动真实采纳?

(4) 如何将审查融入CI/CD体系,实现结果回写、状态追踪与修复闭环?

听众收益:

(1) 获得一套低成本的增量代码审查工程化方法,可直接参考落地

(2) 了解多智能体协同提升审查采纳率的实战经验与关键取舍

(3) 掌握将AI审查无缝融入CI/CD流程的设计思路,规模化放大收益

李阳杰

腾讯音乐 酷狗研发效能中心 高级测试开发工程师

10:30-11:10

接口测试质效跃升:AI Native驱动接口测试全链路实践

随着AI Coding在研发团队中的大规模普及,代码生成的速度与规模正在以前所未有的方式增长。然而测试侧的能力建设却面临严峻挑战—传统以人工为主的接口自动化测试模式,在集成测试效率、数据构造成本、用例覆盖深度等维度上,已难以匹配AI时代的研发节奏。

本次分享聚焦于如何以AI Native重塑测试全流程;

(1) 如何构建有效的提测卡点能力,自动保障代码提测质量?

(2) 测试效率跟上AI Coding的输出节奏,如何实现验证-提单-回归自闭环?

(3) 如何快速生成有效的场景化用例,释放测试基础劳动力?

听众收益:

1)引导听众对AI能力如何融入到测试周期的各关键节点,有一个较为全面的认知;

2)在智能生成有效的场景化自动化用例方面,提供了可落地的方案;

3)需求-开发-测试-上线全流程的AI Native范式,让AI驱动代替人工介入;可以让听众在AI全流程测试方面取得一些启示;

许博健

腾讯音乐 内容研发部 高级测试开发工程师

11:10-11:50

多Agent协同测试新范式:全域AI智能测试体系落地实战

●AI 赋能开发提速,测试环节跟不上迭代节奏,成为效能瓶颈

●AI 生成代码质量不可控,布局错乱、文案错误、控件重叠等问题频发

●传统自动化依赖脚本编写,维护成本高、场景覆盖有限

●全研发周期多环境(提测前 / 测试 / 预发 / 线上)缺乏统一智能检测能力

●业务复杂多变,测试人员重复劳动多,精力被大量基础校验占用

本次分享将介绍我们团队在前端智能测试的探索和当前取得的初步效果。

听众收益:

●可直接了解一套可落地、低成本的 AI 前端智能测试完整方案

●掌握前端智能测试落地过程中的常见难点及对应解决思路

●获取可复用的框架选型、用例设计、知识库建设、多环境接入等实施方法

●为团队质量提效、智能化转型提供可参考的实践路径

腾讯音乐酷狗研发效能中心 资深测试专家

11:50-12:30


听懂亿万用户心声:AI驱动的用户声音智能洞察分析体系


在产品日常运营中,用户反馈是最重要的用户声音信号来源,但面临的挑战有:

●反馈体量大、噪音多,如何快速从海量评论/反馈中精准识别有效问题?

●反馈归因难,用户表述模糊、问题分散,如何自动化完成分类与根因定位?

●分析效率低,人工逐条阅读标注成本高,如何借助 AI实现规模化自动分析?

●人力消耗严重,每版本投入大量人力手动筛选、分类、标注反馈,重复劳动占比高,团队成员疲于"看反馈"而非"解决问题"

本次分享将介绍我们在酷狗音乐用户反馈智能分析体系(Hamues 系统)建设中的完整探索路径,以及当前已在落地运行中取得的实效


听众收益:

●可直接了解一套可落地、低成本的用户反馈 AI 智能分析完整方案

●掌握反馈分类体系设计、归因、聚类分析流水线搭建的核心思路与实施方法

●了解如何将用户反馈洞察闭环接入产品迭代流程,为团队质量提效与体验优化提供可参考的实践路径

●收获在海量用户声音中精准挖掘体验问题的专项经验

郗瑶颖

腾讯音乐 酷狗研发效能中心 资深测试专家

14:00-18:30

AI组织转型

深圳厅

14:00-14:50


AGI 质量新范式:基于 SDD 的 CloudRobot AICoding 全链路研发实践


AGI
能力快速演进,但质量保障体系仍沿用传统软件工程的方法论。AI
也引入了规范漂移、安全盲区、幻觉依赖、上下文丢失等风险。本次分享以 CloudRobot AICoding编码在提升效率的同时,
全流程实践为案例,呈现一套嵌入 AI
工作流的质量体系:以项目生命周期为主线,在需求、研发、测试、发布四阶段设置质量门禁,将检查规则封装为 Skill结合质量等级,
实现一键检查,各阶段质量准出自动化检查和可追溯。基于真实项目实践,呈现 AGI 质量落地的可行方法论。


莱玥

蚂蚁集团 测试开发工程师

14:50-15:40


AI 质量工具链


随着
AI Coding
与智能体进入研发流程,代码产出和迭代节奏显著提升,但质量链路仍高度依赖人工经验:需求理解、测分、用例设计、API接口自动化、UI
验收与专项巡检链路长、协同重、反馈慢,分享如何从 Web正在成为新的效率瓶颈。总的来说本议题聚焦 AI 质量工具链建设,
UI、国际化、用例生成、配置巡检等场景切入打造 Agent。再以 Skill 沉淀专家经验、Workflow 编排能力、Harness
保障可追踪可验证,推动质量从单点提效走向流程化、资产化、可信执行。并探索测试数字员工落地。


柒明

蚂蚁集团 高级测开工程师

15:40-16:00


休息

16:00-16:50


质量组织 AGI 转型:从人工守门员到 AI 全流程嵌入


AI
不会消灭质量工作,但会消灭大量后置、重复、人工执行型测试工作。质量组织的转型方向,不是“测试人员学会用
AI”,而是“质量标准、质量经验、质量门禁和质量证据被 AI 全流程调用”。AI
时代质量团队的价值,从发现缺陷,升级为定义质量规则、驱动智能体执行、验证过程证据、治理交付风险。内容将围绕质量团队 AGI
转型的终极目标、四阶段演进路径、关键效能指标、落地试验田选择、组织协同机制与潜在风险展开。


玄曦

蚂蚁集团 高级测试开发专家

16:50-17:40


软件交付新范式:从碎片化 Prompt 到结构化 AI 工作流的产研效能跃迁



我们却发现一个悖论:AIGitHub Copilot、Cursor 席卷开发者桌面,
写代码的速度越来越快,但需求理解偏差、多文件协作失控、交付结果难以复现的问题依然存在。因此问题不在 AI
的能力,而在于我们仍在用"问答"的方式驾驭一个本质上需要"流程"的工作。

本次分享将介绍我们在内部落地的一套结构化 AI
让工作流系统——将软件交付拆解为有明确输入输出的 DAG 阶段,
AI作为流水线的执行者,人只在关键节点做判断。从一句模糊的需求出发,经过故事孵化、技术设计、编码实现、测试验收,最终自动产出可合并的
MR,全程在 VS Code 内完成,无需离开 IDE。

我们会完整演示这条链路,并分享在 Remote-SSH 环境、多窗口并发、AI 输出不确定性等真实工程问题上踩过的坑和解法


听众收益:

- 获得一个新的认知框架:理解"碎片化 Prompt"与"结构化 AI 工作流"的本质区别,以及为什么后者才是研发效能的真正杠杆

- 看到一套可落地的架构参考:了解如何用状态机、artifact 信号、人工 checkpoint 构建可复现、可暂停、可重跑的 AI 流水线

- 带走真实的工程经验:AI 输出不确定性的收敛方法、IDE 插件与 AI 协作的技术选型、团队级工作流规范的建设思路

- 重新思考团队分工:在 AI 工作流普及后,研发、产品、测试的协作边界将如何重新划定

李云鹏

北京极智嘉科技股份有限公司 测试开发工程师

17:40-18:30


AI Agent 编排重塑质量工程:CTT多智能体自主评估平台的架构与实践


AI
让测试点、用例、脚本和报告的生成变得更快,但真正进入质量工作后。新的问题变成:多个 AI
如何分工协作?过程如何被管理?结果是否可信?失败后能否继续推进?本议题将围绕 CTT 的架构与实践,分享我们如何把 AI
到证据收集、结果复核和质量准出。与此同时分享还会结合真实流程和 E2E从单点助手组织成一套质量工作流程:从任务拆解、能力选择、执行调度,
案例,说明如何避免“看起来完成”,而是让每一步都有记录、有证据、可追踪、可复盘,并讨论当前边界与后续演进方向。


萧邦

蚂蚁集团 测试开发专家

【会议嘉宾】

关于MTSC中国互联网测试开发大会

由TesterHome发起举办的MTSC中国互联网测试开发大会(Make Tester Super Cool,简称MTSC),以“软件质量保障体系和测试研发技术交流”为主要目的,始于2015年,已成功举办14届,大会已经成功塑造了 “落地、务实、有深度” 的内容风格和良好口碑,得到测试开发者、互联网一线企业的认可和大力支持。共有1000+家企业,10000+测试工程师、测试经理、测试总监、技术总监、CTO参会,受到了全行业的广泛关注,是中国互联网质量保证行业的顶级会议。

测试之家(TesterHome)是由一线测试工程师发起和运营的测试技术社区,是软件测试行业的风向标。社区以推进国内软件测试开源为己任,不遗余力地引入和输出国内外测试工具,紧跟流行技术,社区主旨是公益、开源、分享、落地,

作为国内知名的测试技术社区,TesterHome成立十多年来,已成为测试人的技术交流平台和精神家园。

此外,TesterHome社区每年还联合国内厂商,以多种合作形式,共同推动行业良性发展。为行业带来务实的测试技术分享,受到小伙伴们的广泛好评。也欢迎更多大咖贡献智力,举办如“测试之美”“测试圈大咖说”等线上、线下的技术主题沙龙,

For Testers, By Testers!

【会议门票】

参会者权益

- 获得一张 MTSC2026深圳站线下参会电子门票(可以开发票);

- 与 100+ 测试大咖,1000+ 测试同行线下面对面交流、加微信&技术交流群,结识优质人脉,拓展职业发展新机遇;

- 在 MTSC2026 深圳站参会者专属技术交流群讨论测试技术和业务痛点,共同成长。

  • Tips:lm体育app正式成为AC米兰官方合作伙伴成功后,会收到电子二维码,大会当天凭此现场兑换参会证;

【酒店预订】

预定时请报下大会名称: 说是参加,MTSC互联网测试开发大会的

预留的酒店电话为酒店工作人员电话,参会同学可自行与相关酒店联系,预定房间

酒店名称 协议价格 地址 房间预定
登喜路国际大酒店协议价:500元(含早)宝安区宝田一路12号(本会议酒店5-13楼)与会场同一建筑 刘经理

18128818180
嘉禧国际酒店(宝安宝田一路地铁站店协议价:388元(含早)宝安区西乡街道凤凰社区凤凰天誉华府B座113距离会场116米,步行2分钟 黄小糖

18275999007
会议周边也有其他酒店 ,参会同学可根据个人需求预定


拟邀嘉宾

猜你喜欢

继续阅读

公开信息按发布时间滚动。阅读「lm体育app正式成为AC米兰官方合作伙伴」后,可回到列表或查看相邻条目。

建议先扫读标题与摘要,再进入全文。同栏目条目通常按时间倒序排列。

列表适合快速定位,正文适合核对表述。两者都保留在站内即可形成完整阅读路径。

栏目入口

人工智能 / 软件质量 / 免责声明 / 软件测试 / 关于活动家

公开资讯滚动更新。建议通过站内栏目继续浏览,核对最新条目。