- 上线第二天,产品群里甩来两张截图:暗色模式下,主按钮的文字和背景几乎融成一片,看不清;换到某款手机上,首页卡片布局错位、文字被截断。这两类缺陷,我们的视觉回归一条都没报——因为基线只在桌面亮色下存过。等把三档断点、两套主题都补齐,麻烦立刻反噬:基线图数量瞬间 ×6,CI 跑一次视觉回归二十几分钟,截图产物把存储吃得死死的。团队嫌烦,很快又退回「只跑桌面亮色」,兜了一圈回到原点。本篇讲的就是怎... 上线第二天,产品群里甩来两张截图:暗色模式下,主按钮的文字和背景几乎融成一片,看不清;换到某款手机上,首页卡片布局错位、文字被截断。这两类缺陷,我们的视觉回归一条都没报——因为基线只在桌面亮色下存过。等把三档断点、两套主题都补齐,麻烦立刻反噬:基线图数量瞬间 ×6,CI 跑一次视觉回归二十几分钟,截图产物把存储吃得死死的。团队嫌烦,很快又退回「只跑桌面亮色」,兜了一圈回到原点。本篇讲的就是怎...
- 本文提出“评测即门禁”理念:将大模型应用的评测集、执行器、阈值三者代码化并接入CI,实现每次PR自动触发冒烟+基线比对。通过分层执行(PR跑几十条秒级反馈,nightly跑全量)、规则优先裁判、固定裁判版本等设计,让评测从“发版前人工抽查”变为“不可绕过的自动化红线”,真正守住线上质量底线。 本文提出“评测即门禁”理念:将大模型应用的评测集、执行器、阈值三者代码化并接入CI,实现每次PR自动触发冒烟+基线比对。通过分层执行(PR跑几十条秒级反馈,nightly跑全量)、规则优先裁判、固定裁判版本等设计,让评测从“发版前人工抽查”变为“不可绕过的自动化红线”,真正守住线上质量底线。
- 探索如何用AI做自动化测试:涵盖预测分析、AI生成测试用例、测试执行、测试策略、未来趋势。 探索如何用AI做自动化测试:涵盖预测分析、AI生成测试用例、测试执行、测试策略、未来趋势。
- 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流... 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流...
- 不是岗位变少了,是岗位要求彻底重构了大家好,我是某互联网大厂的质量保障团队负责人。上周面试了一个2026届的候选人。简历很漂亮——211硕士,LeetCode刷了300多道,Java基础扎实,简历上写着“熟悉Selenium”“掌握接口测试”“编写测试用例3000条”。我问了第一个问题:“如果Agent在这里调用工具失败,你的重试和兜底机制是什么?”他愣住了。沉默了几秒,说:“我……没接触过... 不是岗位变少了,是岗位要求彻底重构了大家好,我是某互联网大厂的质量保障团队负责人。上周面试了一个2026届的候选人。简历很漂亮——211硕士,LeetCode刷了300多道,Java基础扎实,简历上写着“熟悉Selenium”“掌握接口测试”“编写测试用例3000条”。我问了第一个问题:“如果Agent在这里调用工具失败,你的重试和兜底机制是什么?”他愣住了。沉默了几秒,说:“我……没接触过...
- 本文按实际脚本驱动浏览器的执行顺序,讲解如何复用表单校验逻辑并实现无人值守的可靠定位,涵盖前台校验去重、等待策略、定位失效处理与结果核对等落地细节。 本文按实际脚本驱动浏览器的执行顺序,讲解如何复用表单校验逻辑并实现无人值守的可靠定位,涵盖前台校验去重、等待策略、定位失效处理与结果核对等落地细节。
- 前端迭代这两年越来越快,组件库换了两轮,断点从两个加到四个。伴随而来的是一件很具体的事:视觉回归的基线图,从最初的几十张攒到了两千多张。现在每晚 CI 跑视觉回归要 40 分钟,第二天早上打开报告红灯 200 张。翻一遍,180 张是字体渲染差异、抗锯齿抖动、动画还没停下来就截了图;剩下 20 张里,真缺陷可能只有一两个。于是团队形成了一个默契动作:全选,点 approve,更新基线。三个月... 前端迭代这两年越来越快,组件库换了两轮,断点从两个加到四个。伴随而来的是一件很具体的事:视觉回归的基线图,从最初的几十张攒到了两千多张。现在每晚 CI 跑视觉回归要 40 分钟,第二天早上打开报告红灯 200 张。翻一遍,180 张是字体渲染差异、抗锯齿抖动、动画还没停下来就截了图;剩下 20 张里,真缺陷可能只有一两个。于是团队形成了一个默契动作:全选,点 approve,更新基线。三个月...
- 本文揭示压测中一个隐蔽却致命的问题:施压端自身饱和导致数据失真——报告中漂亮的180ms延迟实为施压机排队时间,而非被测服务真实响应。文章系统剖析四大物理根因(端口耗尽、TIME_WAIT堆积、TLS未复用、CPU/句柄打满),提出“先标定单机上限、再决定是否分布式”原则,并给出含预热机制、健康门禁与双源验证(k6指标+`/proc`采集)的可落地方案,强调:无施压端体检的压测报告,不可信。 本文揭示压测中一个隐蔽却致命的问题:施压端自身饱和导致数据失真——报告中漂亮的180ms延迟实为施压机排队时间,而非被测服务真实响应。文章系统剖析四大物理根因(端口耗尽、TIME_WAIT堆积、TLS未复用、CPU/句柄打满),提出“先标定单机上限、再决定是否分布式”原则,并给出含预热机制、健康门禁与双源验证(k6指标+`/proc`采集)的可落地方案,强调:无施压端体检的压测报告,不可信。
- 本文提供一份可直接落地的AI测试工具四维加权评估表,聚焦能力、可运维性(权重35%)、集成与组织四维度,强调“demo演最好一天,评估算最差一天”。含一票否决项与两周真实POC验证法,助团队规避模型升级失效、日志难定位、资产锁定等典型陷阱,实现理性选型。 本文提供一份可直接落地的AI测试工具四维加权评估表,聚焦能力、可运维性(权重35%)、集成与组织四维度,强调“demo演最好一天,评估算最差一天”。含一票否决项与两周真实POC验证法,助团队规避模型升级失效、日志难定位、资产锁定等典型陷阱,实现理性选型。
- 本文揭示AI生成单元测试的致命陷阱:高覆盖率(95%)≠ 高质量测试。AI常“照抄实现写断言”,导致测试恒真、无法发现逻辑错误(如满减与折扣顺序颠倒)。真正衡量测试能力的是**变异测试得分(mutation score)**——通过故意注入代码缺陷,检验测试能否捕获。覆盖率只答“是否执行”,mutation score才答“能否揪错”。AI时代,该用它为测试集“体检”。 本文揭示AI生成单元测试的致命陷阱:高覆盖率(95%)≠ 高质量测试。AI常“照抄实现写断言”,导致测试恒真、无法发现逻辑错误(如满减与折扣顺序颠倒)。真正衡量测试能力的是**变异测试得分(mutation score)**——通过故意注入代码缺陷,检验测试能否捕获。覆盖率只答“是否执行”,mutation score才答“能否揪错”。AI时代,该用它为测试集“体检”。
- 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流... 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流...
- 四、混淆矩阵:错在哪个方向比错了多少更要命Kappa 告诉你裁判整体准不准,混淆矩阵告诉你它错在哪一侧。把人工金标准放行进、裁判判定放列进,二分类下就是一张 2×2 的表。对角线上是判对的(都说合格、都说该拦),反对角线上是两类错误,而这两类错误的代价完全不对等:人工说该拦、裁判却放行,是「放过」——坏答案混进了选型结果,这是最贵的一种错;人工说合格、裁判却判该拦,是「误杀」——好答案被冤... 四、混淆矩阵:错在哪个方向比错了多少更要命Kappa 告诉你裁判整体准不准,混淆矩阵告诉你它错在哪一侧。把人工金标准放行进、裁判判定放列进,二分类下就是一张 2×2 的表。对角线上是判对的(都说合格、都说该拦),反对角线上是两类错误,而这两类错误的代价完全不对等:人工说该拦、裁判却放行,是「放过」——坏答案混进了选型结果,这是最贵的一种错;人工说合格、裁判却判该拦,是「误杀」——好答案被冤...
- 本文介绍如何用DeepSeek Harness(DSH)与腾讯Workbuddy协同,10分钟自动生成高质量测试用例:DSH提供执行能力,Workbuddy提供模型与规范封装;支持PRD/接口文档输入,覆盖正常流、异常场景与边界值。手写低效,AI初稿+人工复核才是提效关键。 本文介绍如何用DeepSeek Harness(DSH)与腾讯Workbuddy协同,10分钟自动生成高质量测试用例:DSH提供执行能力,Workbuddy提供模型与规范封装;支持PRD/接口文档输入,覆盖正常流、异常场景与边界值。手写低效,AI初稿+人工复核才是提效关键。
- 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流... 上周接了个活,一个电商中台系统的接口回归测试。需求文档87页,涉及用户、订单、支付、库存四个模块,前后端分离,接口文档挂在Swagger上,但有些字段的校验规则只写在PRD的表格注释里。按老规矩,我得先花一天啃文档,再花一天写接口用例,UI自动化那块如果时间够就补几页,不够就手工点。测试报告?等跑完再说。这次我换了个路子。把PRD和Swagger文件一起丢进工作区,配好执行环境,剩下的交给流...
- 新服务上线时DNS记录延迟创建,导致客户端缓存“域名不存在”(NXDOMAIN)负响应。即使权威DNS已更新,多层缓存仍会延续故障数分钟。本文详解负缓存机制、真实恢复延迟及可控发布与验证方法。 新服务上线时DNS记录延迟创建,导致客户端缓存“域名不存在”(NXDOMAIN)负响应。即使权威DNS已更新,多层缓存仍会延续故障数分钟。本文详解负缓存机制、真实恢复延迟及可控发布与验证方法。
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签