- 1 测试用例定义测试用例(TestCase)为测试对象编制一种测试输入、执行条件和预期结果;用例可以体现测试方案、方法、技术和策略;用例的内容一般包含:# 测试对象名称# 测试项# 测试目标# 测试环境# 测试输入# 测试步骤# 预期结果# 测试脚本等平常我们最简化的测试用例至少应该包含测试输入和预期结果。 2 测试用例设计原则测试用例应覆盖三类事件:# 1、基本事件:根据需求需要实现所有... 1 测试用例定义测试用例(TestCase)为测试对象编制一种测试输入、执行条件和预期结果;用例可以体现测试方案、方法、技术和策略;用例的内容一般包含:# 测试对象名称# 测试项# 测试目标# 测试环境# 测试输入# 测试步骤# 预期结果# 测试脚本等平常我们最简化的测试用例至少应该包含测试输入和预期结果。 2 测试用例设计原则测试用例应覆盖三类事件:# 1、基本事件:根据需求需要实现所有...
- 【自动化登陆页面测试脚本】python+selenium+excel表格,自动化页面登录测试 【自动化登陆页面测试脚本】python+selenium+excel表格,自动化页面登录测试
- Eolink Apikit 的图形用例是指通过图形化的方式去表现 API 流程测试。它包括了条件选择器、单个 API 步骤和操作集等组件。相较于前面推荐的表格化的通用用例,图形用例可以让测试人员更方便地设计和管理 API 流程测试,同时也更加的灵活。 添加图形用例进入测试用例管理页面,点击 添加用例 按钮,在弹窗中输入用例名称等信息,选择图形用例,然后点击确定即可。 添加图形用例步骤点击线段... Eolink Apikit 的图形用例是指通过图形化的方式去表现 API 流程测试。它包括了条件选择器、单个 API 步骤和操作集等组件。相较于前面推荐的表格化的通用用例,图形用例可以让测试人员更方便地设计和管理 API 流程测试,同时也更加的灵活。 添加图形用例进入测试用例管理页面,点击 添加用例 按钮,在弹窗中输入用例名称等信息,选择图形用例,然后点击确定即可。 添加图形用例步骤点击线段...
- 流程测试用例是为验证特定业务流程而设计和编写的测试案例,专注于检查系统或应用程序在执行某一业务流程时的正确性、稳定性和可靠性。一个业务流程可能涉及多个步骤、多个用户交互和多个系统组件的协作,流程测试用例有助于确保整个流程在各种情况下都能正常运行。 流程测试用例是为验证特定业务流程而设计和编写的测试案例,专注于检查系统或应用程序在执行某一业务流程时的正确性、稳定性和可靠性。一个业务流程可能涉及多个步骤、多个用户交互和多个系统组件的协作,流程测试用例有助于确保整个流程在各种情况下都能正常运行。
- 本文揭示AI测试维护的核心陷阱:字段变更易引发断言误判。主张从“改脚本”转向“判影响”,依托OpenAPI与业务不变量生成候选影响清单,聚焦高风险链路闭环验证,并将关键断言纳入契约回归,实现可追溯、可复用的质量门禁。 本文揭示AI测试维护的核心陷阱:字段变更易引发断言误判。主张从“改脚本”转向“判影响”,依托OpenAPI与业务不变量生成候选影响清单,聚焦高风险链路闭环验证,并将关键断言纳入契约回归,实现可追溯、可复用的质量门禁。
- 本文揭示AI模型评测中厂商发布页数字“悄然变动”的行业风险,指出依赖截图引用的脆弱性。提出“留痕+复现”双轨实践:用哈希快照捕获变更,以可复现评测替代被动采信。强调差异即信号,需优先对齐口径而非质疑真假。核心主张:测试结论必须锚定在自己能重跑、可追溯、有置信区间的证据上。 本文揭示AI模型评测中厂商发布页数字“悄然变动”的行业风险,指出依赖截图引用的脆弱性。提出“留痕+复现”双轨实践:用哈希快照捕获变更,以可复现评测替代被动采信。强调差异即信号,需优先对齐口径而非质疑真假。核心主张:测试结论必须锚定在自己能重跑、可追溯、有置信区间的证据上。
- 上线评审会开到第二十分钟,卡在同一个问题上:这个智能体到底能不能上线。产品说演示很顺;算法说场景集通过率不错;安全说没报漏洞;运维说回滚预案写好了;业务负责人最后只问了一句『你们谁敢签字』,五个人给出了五种『通过』的定义。散会你回到工位翻测试计划,发现那五种定义合起来其实是九个字:功能、性能、安全。这不是谁偷懒,是我们最熟练的那套三板斧——而它在智能体身上少了两块板。九月中旬的一条行业消息,... 上线评审会开到第二十分钟,卡在同一个问题上:这个智能体到底能不能上线。产品说演示很顺;算法说场景集通过率不错;安全说没报漏洞;运维说回滚预案写好了;业务负责人最后只问了一句『你们谁敢签字』,五个人给出了五种『通过』的定义。散会你回到工位翻测试计划,发现那五种定义合起来其实是九个字:功能、性能、安全。这不是谁偷懒,是我们最熟练的那套三板斧——而它在智能体身上少了两块板。九月中旬的一条行业消息,...
- AI Agent自进化不是让模型“自学成才”,而是构建工程化闭环:评测发现问题→沉淀经验→更新Prompt/Skill→回归验证→灰度发布→反馈回流。核心在于Harness层(Prompt、Skill、Memory等)的持续优化,需借鉴CI/CD、自动化测试、Trace分析等软件工程实践,实现可验证、可回滚、可管控的真正持续改进。 AI Agent自进化不是让模型“自学成才”,而是构建工程化闭环:评测发现问题→沉淀经验→更新Prompt/Skill→回归验证→灰度发布→反馈回流。核心在于Harness层(Prompt、Skill、Memory等)的持续优化,需借鉴CI/CD、自动化测试、Trace分析等软件工程实践,实现可验证、可回滚、可管控的真正持续改进。
- 本文揭示AI Agent测试的核心挑战:接口正常≠业务正确。以“退款退错”为例,指出Agent路径错误(如猜订单号、越界重试)比接口失败更危险。提出用Trace断言验证调用顺序、参数来源、归属校验与停止条件,并强调回归测试需沉淀真实坏轨迹,实现从结果验证到行为可控的升级。 本文揭示AI Agent测试的核心挑战:接口正常≠业务正确。以“退款退错”为例,指出Agent路径错误(如猜订单号、越界重试)比接口失败更危险。提出用Trace断言验证调用顺序、参数来源、归属校验与停止条件,并强调回归测试需沉淀真实坏轨迹,实现从结果验证到行为可控的升级。
- AI补丁常因环境差异导致线上失败:单测通过但真实服务启动报错。本文提出四层验证门——单元、集成、服务冒烟、业务冒烟,强调必须用最小真实服务执行关键请求(如模型加载、健康检查、推理),并留存commit、镜像、日志、Trace等可复盘证据,让AI改动可追溯、可归因。 AI补丁常因环境差异导致线上失败:单测通过但真实服务启动报错。本文提出四层验证门——单元、集成、服务冒烟、业务冒烟,强调必须用最小真实服务执行关键请求(如模型加载、健康检查、推理),并留存commit、镜像、日志、Trace等可复盘证据,让AI改动可追溯、可归因。
- 本文介绍如何将Kev——一种类型化决策AI模型——作为可测试服务进行验证。它不生成文本,而是针对结构化问题(noul/choice/score)返回概率化答案。重点在于:建立本地HTTP服务、编写接口契约测试、验证多题隔离与选项顺序稳定性、开展概率校准,并构建可回归的冻结样本集。核心理念:把AI当被测对象,而非黑盒顾问。 本文介绍如何将Kev——一种类型化决策AI模型——作为可测试服务进行验证。它不生成文本,而是针对结构化问题(noul/choice/score)返回概率化答案。重点在于:建立本地HTTP服务、编写接口契约测试、验证多题隔离与选项顺序稳定性、开展概率校准,并构建可回归的冻结样本集。核心理念:把AI当被测对象,而非黑盒顾问。
- Google提出Agent质量飞轮核心原则:**优化器不可自评**。若同一AI既修改Prompt又评分,易“游戏化指标”,而非真实提升体验。需严格解耦Optimizer与Evaluator,冻结测试集、Rubric和基线版本,实施盲测与多维验证(如保留集、硬指标、人工盲评、失败类型迁移),确保分数上涨反映真实改进。 Google提出Agent质量飞轮核心原则:**优化器不可自评**。若同一AI既修改Prompt又评分,易“游戏化指标”,而非真实提升体验。需严格解耦Optimizer与Evaluator,冻结测试集、Rubric和基线版本,实施盲测与多维验证(如保留集、硬指标、人工盲评、失败类型迁移),确保分数上涨反映真实改进。
- OpenAI旧Evals进入退役倒计时:Agent测评别再押在一个平台按钮上 真正会丢的不是一个界面很多团队说“我们做过几十条 Agent Eval”,实际资产只存在某个平台的网页按钮里:案例是谁写的、标准答案是什么、评分器怎么判、失败时调用了哪些工具,全靠系统内部保存。平台一迁,留下的可能只是一张总分截图。OpenAI 已公布旧 Evals 的只读与关闭时间。无论是否使用该平台,这都是一个... OpenAI旧Evals进入退役倒计时:Agent测评别再押在一个平台按钮上 真正会丢的不是一个界面很多团队说“我们做过几十条 Agent Eval”,实际资产只存在某个平台的网页按钮里:案例是谁写的、标准答案是什么、评分器怎么判、失败时调用了哪些工具,全靠系统内部保存。平台一迁,留下的可能只是一张总分截图。OpenAI 已公布旧 Evals 的只读与关闭时间。无论是否使用该平台,这都是一个...
- 评审会上把质量报告投出来。总监三秒划到最后一行:『所以能不能上?』开发盯着自己模块那三条红,其余一眼不看。测试同行从头核对附录里的分母和区间,眉头越皱越紧。三类人读的是同一份文档,问的却是三个完全不同的问题——而你只准备了一份答案。这份报告大概率会收获一串『收到』。低回应率不是因为你数据不全,恰恰相反,是因为你把一份报告当成了面向所有人的通用件。 为什么你的报告只换来一堆『收到』一份为所有读... 评审会上把质量报告投出来。总监三秒划到最后一行:『所以能不能上?』开发盯着自己模块那三条红,其余一眼不看。测试同行从头核对附录里的分母和区间,眉头越皱越紧。三类人读的是同一份文档,问的却是三个完全不同的问题——而你只准备了一份答案。这份报告大概率会收获一串『收到』。低回应率不是因为你数据不全,恰恰相反,是因为你把一份报告当成了面向所有人的通用件。 为什么你的报告只换来一堆『收到』一份为所有读...
- 本文提出AI质量报告的可复现性设计:通过模型、prompt、数据集、随机种子、运行标识五要素脚注,确保每条结论自带“配方”。纯标准库实现自动采集、校验与标注,杜绝配置漂移导致的误判,让报告从备忘录升级为可验证证据。 本文提出AI质量报告的可复现性设计:通过模型、prompt、数据集、随机种子、运行标识五要素脚注,确保每条结论自带“配方”。纯标准库实现自动采集、校验与标注,杜绝配置漂移导致的误判,让报告从备忘录升级为可验证证据。
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签