- OpenAI宣布2026年11月终止向SpaceX旗下Cursor提供模型服务,主因信任缺失。此事警示测试人:工具可被断供,能力才是核心。AI时代,唯有掌握大模型原理、质量工程与落地能力的复合型测试人才不可替代。 OpenAI宣布2026年11月终止向SpaceX旗下Cursor提供模型服务,主因信任缺失。此事警示测试人:工具可被断供,能力才是核心。AI时代,唯有掌握大模型原理、质量工程与落地能力的复合型测试人才不可替代。
- 本文揭秘如何将测试经验封装为Claude可复用的“Skill”——一个结构化文件夹,含SKILL.md核心指令、references参考文档与scripts执行脚本。通过渐进式加载机制,实现精准触发、高效复用,让AI不再从零学起,真正成为测试工程师的智能协作者。 本文揭秘如何将测试经验封装为Claude可复用的“Skill”——一个结构化文件夹,含SKILL.md核心指令、references参考文档与scripts执行脚本。通过渐进式加载机制,实现精准触发、高效复用,让AI不再从零学起,真正成为测试工程师的智能协作者。
- 企业AI Agent落地后,真正难题在于:为何报价出错?看过哪些资料?调用哪个工具?变更影响哪些场景?这无法靠Prompt或RAG解决。测试团队需转型为“质量FDE”,将客户现场的流程、权限、数据等转化为可验证、可复用的质量资产。DeepSeek Harness提供可追溯的运行轨迹,知识图谱应升级为“质量部署图谱”,支撑精准变更分析与证据驱动的发布门禁。( 企业AI Agent落地后,真正难题在于:为何报价出错?看过哪些资料?调用哪个工具?变更影响哪些场景?这无法靠Prompt或RAG解决。测试团队需转型为“质量FDE”,将客户现场的流程、权限、数据等转化为可验证、可复用的质量资产。DeepSeek Harness提供可追溯的运行轨迹,知识图谱应升级为“质量部署图谱”,支撑精准变更分析与证据驱动的发布门禁。(
- 从一个退款 Agent 的越权风险,看 AI 测试开发该如何逐步落地凌晨的大促结束后,售后 Agent 还在处理退款。回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用了退款工具;另一次,它把“工具调用失败”说成了“退款已成功”。传统自动化看见的是页面、接口和数据库;普通 LLM 评... 从一个退款 Agent 的越权风险,看 AI 测试开发该如何逐步落地凌晨的大促结束后,售后 Agent 还在处理退款。回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用了退款工具;另一次,它把“工具调用失败”说成了“退款已成功”。传统自动化看见的是页面、接口和数据库;普通 LLM 评...
- 先算一笔账:一个 Agent 跑复杂长任务,API 成本会随任务长度放大,一旦失控打转,烧掉的不只是 token,还有用户的信任和耐心。这是质量问题,也是真金白银的经营问题——这正是大厂把 AI 测试推到前所未有高度的真实原因。我们从一个最近的现象级项目说起。 一个信号:Agent 开始"干活"了2026 年 8 月 13 日晚,DeepSeek 发布了首款开源 Agent 产品 DeepS... 先算一笔账:一个 Agent 跑复杂长任务,API 成本会随任务长度放大,一旦失控打转,烧掉的不只是 token,还有用户的信任和耐心。这是质量问题,也是真金白银的经营问题——这正是大厂把 AI 测试推到前所未有高度的真实原因。我们从一个最近的现象级项目说起。 一个信号:Agent 开始"干活"了2026 年 8 月 13 日晚,DeepSeek 发布了首款开源 Agent 产品 DeepS...
- 本文整理10道DeepSeek Harness(dsh)高频面试题,涵盖概念理解、实践测试与开放思辨,聚焦Agent自进化带来的新挑战——如“一切皆插件”架构、非确定性输出验证、Revertible Effects安全机制等,每题附考察点与可复用思路,助你直击AI测试核心能力。 本文整理10道DeepSeek Harness(dsh)高频面试题,涵盖概念理解、实践测试与开放思辨,聚焦Agent自进化带来的新挑战——如“一切皆插件”架构、非确定性输出验证、Revertible Effects安全机制等,每题附考察点与可复用思路,助你直击AI测试核心能力。
- 本文回溯测试职业变迁史,剖析DeepSeek Harness(GitHub最快涨星项目之一)引发的三大范式变革:测试对象从“静态”走向“自进化”,质量职能从下游上移至架构层,人机分工转向“定义目标+验收结果”。下一站,是成为敏感、善思、长期主义的质量架构师。 本文回溯测试职业变迁史,剖析DeepSeek Harness(GitHub最快涨星项目之一)引发的三大范式变革:测试对象从“静态”走向“自进化”,质量职能从下游上移至架构层,人机分工转向“定义目标+验收结果”。下一站,是成为敏感、善思、长期主义的质量架构师。
- 本文实测DeepSeek Harness(dsh)在测试开发五环节中的实际替代能力:需求解析(50%)、用例设计(70%)、脚本编写(60%)、执行调度(30%)、缺陷定位(40%),加权综合替代度约50%-67%。AI擅重复劳动,不代判断力。 本文实测DeepSeek Harness(dsh)在测试开发五环节中的实际替代能力:需求解析(50%)、用例设计(70%)、脚本编写(60%)、执行调度(30%)、缺陷定位(40%),加权综合替代度约50%-67%。AI擅重复劳动,不代判断力。
- 本文详解大模型接口三大边界问题:输入上下文溢出、输出max_tokens截断、计费token统计偏差。结合两起400错误实战案例,给出可落地的边界测试方法、代码用例与工程规范,助你直击AI测试面试核心考点。 本文详解大模型接口三大边界问题:输入上下文溢出、输出max_tokens截断、计费token统计偏差。结合两起400错误实战案例,给出可落地的边界测试方法、代码用例与工程规范,助你直击AI测试面试核心考点。
- 本文揭秘大模型性能测试核心差异:告别传统QPS/RT,聚焦TTFT(首字延迟)、TPOT(逐字间隔)等流式指标。通过真实大促事故(首字延迟从0.8秒飙至15秒),剖析容量规划缺失、KV cache打满、无降级等痛点,并给出阶梯压测、拐点识别、混长文本等实战方法,助你应对AI面试高频题。 本文揭秘大模型性能测试核心差异:告别传统QPS/RT,聚焦TTFT(首字延迟)、TPOT(逐字间隔)等流式指标。通过真实大促事故(首字延迟从0.8秒飙至15秒),剖析容量规划缺失、KV cache打满、无降级等痛点,并给出阶梯压测、拐点识别、混长文本等实战方法,助你应对AI面试高频题。
- AI安全测试聚焦“模型服从性”:不攻代码,而用自然语言诱导模型叛变。本文剖析两次真实提示词注入事故,详解红队测试四步法——攻击库建设、边界测试、输出检测与持续回归,强调分层防御与工程化落地。 AI安全测试聚焦“模型服从性”:不攻代码,而用自然语言诱导模型叛变。本文剖析两次真实提示词注入事故,详解红队测试四步法——攻击库建设、边界测试、输出检测与持续回归,强调分层防御与工程化落地。
- AI 测试开发面试高频题:“流式输出接口怎么测?和普通 HTTP 有什么区别?”普通接口测"一次响应",流式接口测"一条事件流"——首字快不快、中间卡不卡、结尾完不完整、断了怎么办。这篇用一次"机器人说半句话"的客诉,把 SSE 的测试点讲全。 一、真实客诉:你们机器人怎么说话说一半?某保险公司的智能顾问用 SSE 流式输出。上线后陆续有用户投诉:"你们机器人说话说一半,是不是故意逗我?“截... AI 测试开发面试高频题:“流式输出接口怎么测?和普通 HTTP 有什么区别?”普通接口测"一次响应",流式接口测"一条事件流"——首字快不快、中间卡不卡、结尾完不完整、断了怎么办。这篇用一次"机器人说半句话"的客诉,把 SSE 的测试点讲全。 一、真实客诉:你们机器人怎么说话说一半?某保险公司的智能顾问用 SSE 流式输出。上线后陆续有用户投诉:"你们机器人说话说一半,是不是故意逗我?“截...
- AI测试开发高频题:测Agent≠测接口,核心是验证“决策链是否失控”。本文以深夜烧万元的真实事故切入,详解如何通过轨迹记录、循环检测与三重熔断(步数/Token/时间)保障Agent可靠性,并将“不失控”写入自动化测试用例。 AI测试开发高频题:测Agent≠测接口,核心是验证“决策链是否失控”。本文以深夜烧万元的真实事故切入,详解如何通过轨迹记录、循环检测与三重熔断(步数/Token/时间)保障Agent可靠性,并将“不失控”写入自动化测试用例。
- AI 测试开发面试高频题:“大模型的输出是不确定的,你怎么做自动化测试?”这篇用一个真实线上故障,完整还原 AI 测试开发工程师的处理过程:怎么定位、怎么写代码、最后沉淀成什么方法。 一、真实故障:断言天天红,后来有人把它关了某电商公司的智能客服项目,测试工程师小周给"订单状态查询"这个 LLM 接口写了自动化用例,断言写得很传统:assert response.text == "您的订单 ... AI 测试开发面试高频题:“大模型的输出是不确定的,你怎么做自动化测试?”这篇用一个真实线上故障,完整还原 AI 测试开发工程师的处理过程:怎么定位、怎么写代码、最后沉淀成什么方法。 一、真实故障:断言天天红,后来有人把它关了某电商公司的智能客服项目,测试工程师小周给"订单状态查询"这个 LLM 接口写了自动化用例,断言写得很传统:assert response.text == "您的订单 ...
- TestMan测试平台通过AI技术推动测试从自动化迈向智能化。平台利用大模型解析需求文档,自动生成高覆盖率的测试用例,减少人工设计时间;引入AI视觉识别(如YOLO算法)增强UI自动化测试的鲁棒性,通过元素识别和场景感知降低脚本维护成本;AI测试智能体则承担任务分解、探索测试和结果分析,辅助测试人员聚焦业务风险。技术底座支持容器化、跨平台和DevOps集成,形成“感知-决策-执行”闭环,实现测试工 TestMan测试平台通过AI技术推动测试从自动化迈向智能化。平台利用大模型解析需求文档,自动生成高覆盖率的测试用例,减少人工设计时间;引入AI视觉识别(如YOLO算法)增强UI自动化测试的鲁棒性,通过元素识别和场景感知降低脚本维护成本;AI测试智能体则承担任务分解、探索测试和结果分析,辅助测试人员聚焦业务风险。技术底座支持容器化、跨平台和DevOps集成,形成“感知-决策-执行”闭环,实现测试工
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签