- 刷到“DeepSeek扩招,全部非AI研究方向”,一个在职测试人的脑内小剧场,大概能连演三集。第一集:终于轮到有工程经验的人了?第二集:点开岗位——服务端开发、Agent弹性计算……等一下,测试呢?第三集:招聘页面关了,回归报告还没写完。最扎心的地方就在这里。AI公司的招聘消息,你一条没少看;新工具,你也收藏了不少。但真要问一句“这次机会,我凭什么接得住”,答案又卡住了。尤其是已经工作几年的... 刷到“DeepSeek扩招,全部非AI研究方向”,一个在职测试人的脑内小剧场,大概能连演三集。第一集:终于轮到有工程经验的人了?第二集:点开岗位——服务端开发、Agent弹性计算……等一下,测试呢?第三集:招聘页面关了,回归报告还没写完。最扎心的地方就在这里。AI公司的招聘消息,你一条没少看;新工具,你也收藏了不少。但真要问一句“这次机会,我凭什么接得住”,答案又卡住了。尤其是已经工作几年的...
- 直播电商大促性能需求不能只提“10万并发、P95<500ms”。需明确流量模型(如30秒尖峰)、业务混合比例、支付真实性及降级策略。并发是结果而非输入,压测须还原真实路径、验证交易正确性,并交付可执行的容量账与退让方案。 直播电商大促性能需求不能只提“10万并发、P95<500ms”。需明确流量模型(如30秒尖峰)、业务混合比例、支付真实性及降级策略。并发是结果而非输入,压测须还原真实路径、验证交易正确性,并交付可执行的容量账与退让方案。
- 本文揭示长上下文模型在代码评审中的认知盲区:读完仓库不等于读懂变更半径。枚举值修改引发多系统故障,暴露静态理解与真实影响间的鸿沟。提出四层影响图(静态依赖、运行调用、数据血缘、业务责任)和证据驱动的风险评估范式,强调测试工程师需从“写用例”转向“组织变更证据”。 本文揭示长上下文模型在代码评审中的认知盲区:读完仓库不等于读懂变更半径。枚举值修改引发多系统故障,暴露静态理解与真实影响间的鸿沟。提出四层影响图(静态依赖、运行调用、数据血缘、业务责任)和证据驱动的风险评估范式,强调测试工程师需从“写用例”转向“组织变更证据”。
- 一次优惠券超发事故揭示缓存与数据库一致性本质:Redis仅作读加速,最终裁决必须由MySQL事务+唯一约束保障。故障源于缓存删除失败+缺乏原子扣减条件,导致317张券超发。 一次优惠券超发事故揭示缓存与数据库一致性本质:Redis仅作读加速,最终裁决必须由MySQL事务+唯一约束保障。故障源于缓存删除失败+缺乏原子扣减条件,导致317张券超发。
- 物流事件升级至v4仅新增`proof_image_url`字段,却致多下游报错——因消费者采用“禁止额外字段”的严格反序列化。兼容性不由生产者单方面定义,而取决于真实消费逻辑。契约测试必须调用实际消费代码,并验证语义、时序与幂等性。 物流事件升级至v4仅新增`proof_image_url`字段,却致多下游报错——因消费者采用“禁止额外字段”的严格反序列化。兼容性不由生产者单方面定义,而取决于真实消费逻辑。契约测试必须调用实际消费代码,并验证语义、时序与幂等性。
- 电商结算新功能“跨店优惠按金额分摊”上线在即。AI生成代码+326条测试全通过,覆盖率96%,但暴露同源偏差风险:测试与实现共享错误前提,掩盖分摊公平性缺陷。需以业务不变量(如总额精确、商品限额、顺序无关)为锚,辅以变异测试和黄金样本验证,确保账务零误差。 电商结算新功能“跨店优惠按金额分摊”上线在即。AI生成代码+326条测试全通过,覆盖率96%,但暴露同源偏差风险:测试与实现共享错误前提,掩盖分摊公平性缺陷。需以业务不变量(如总额精确、商品限额、顺序无关)为锚,辅以变异测试和黄金样本验证,确保账务零误差。
- OpenAI宣布2026年11月终止向SpaceX旗下Cursor提供模型服务,主因信任缺失。此事警示测试人:工具可被断供,能力才是核心。AI时代,唯有掌握大模型原理、质量工程与落地能力的复合型测试人才不可替代。 OpenAI宣布2026年11月终止向SpaceX旗下Cursor提供模型服务,主因信任缺失。此事警示测试人:工具可被断供,能力才是核心。AI时代,唯有掌握大模型原理、质量工程与落地能力的复合型测试人才不可替代。
- 本文揭秘如何将测试经验封装为Claude可复用的“Skill”——一个结构化文件夹,含SKILL.md核心指令、references参考文档与scripts执行脚本。通过渐进式加载机制,实现精准触发、高效复用,让AI不再从零学起,真正成为测试工程师的智能协作者。 本文揭秘如何将测试经验封装为Claude可复用的“Skill”——一个结构化文件夹,含SKILL.md核心指令、references参考文档与scripts执行脚本。通过渐进式加载机制,实现精准触发、高效复用,让AI不再从零学起,真正成为测试工程师的智能协作者。
- 企业AI Agent落地后,真正难题在于:为何报价出错?看过哪些资料?调用哪个工具?变更影响哪些场景?这无法靠Prompt或RAG解决。测试团队需转型为“质量FDE”,将客户现场的流程、权限、数据等转化为可验证、可复用的质量资产。DeepSeek Harness提供可追溯的运行轨迹,知识图谱应升级为“质量部署图谱”,支撑精准变更分析与证据驱动的发布门禁。( 企业AI Agent落地后,真正难题在于:为何报价出错?看过哪些资料?调用哪个工具?变更影响哪些场景?这无法靠Prompt或RAG解决。测试团队需转型为“质量FDE”,将客户现场的流程、权限、数据等转化为可验证、可复用的质量资产。DeepSeek Harness提供可追溯的运行轨迹,知识图谱应升级为“质量部署图谱”,支撑精准变更分析与证据驱动的发布门禁。(
- 从一个退款 Agent 的越权风险,看 AI 测试开发该如何逐步落地凌晨的大促结束后,售后 Agent 还在处理退款。回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用了退款工具;另一次,它把“工具调用失败”说成了“退款已成功”。传统自动化看见的是页面、接口和数据库;普通 LLM 评... 从一个退款 Agent 的越权风险,看 AI 测试开发该如何逐步落地凌晨的大促结束后,售后 Agent 还在处理退款。回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用了退款工具;另一次,它把“工具调用失败”说成了“退款已成功”。传统自动化看见的是页面、接口和数据库;普通 LLM 评...
- 先算一笔账:一个 Agent 跑复杂长任务,API 成本会随任务长度放大,一旦失控打转,烧掉的不只是 token,还有用户的信任和耐心。这是质量问题,也是真金白银的经营问题——这正是大厂把 AI 测试推到前所未有高度的真实原因。我们从一个最近的现象级项目说起。 一个信号:Agent 开始"干活"了2026 年 8 月 13 日晚,DeepSeek 发布了首款开源 Agent 产品 DeepS... 先算一笔账:一个 Agent 跑复杂长任务,API 成本会随任务长度放大,一旦失控打转,烧掉的不只是 token,还有用户的信任和耐心。这是质量问题,也是真金白银的经营问题——这正是大厂把 AI 测试推到前所未有高度的真实原因。我们从一个最近的现象级项目说起。 一个信号:Agent 开始"干活"了2026 年 8 月 13 日晚,DeepSeek 发布了首款开源 Agent 产品 DeepS...
- 本文整理10道DeepSeek Harness(dsh)高频面试题,涵盖概念理解、实践测试与开放思辨,聚焦Agent自进化带来的新挑战——如“一切皆插件”架构、非确定性输出验证、Revertible Effects安全机制等,每题附考察点与可复用思路,助你直击AI测试核心能力。 本文整理10道DeepSeek Harness(dsh)高频面试题,涵盖概念理解、实践测试与开放思辨,聚焦Agent自进化带来的新挑战——如“一切皆插件”架构、非确定性输出验证、Revertible Effects安全机制等,每题附考察点与可复用思路,助你直击AI测试核心能力。
- 本文回溯测试职业变迁史,剖析DeepSeek Harness(GitHub最快涨星项目之一)引发的三大范式变革:测试对象从“静态”走向“自进化”,质量职能从下游上移至架构层,人机分工转向“定义目标+验收结果”。下一站,是成为敏感、善思、长期主义的质量架构师。 本文回溯测试职业变迁史,剖析DeepSeek Harness(GitHub最快涨星项目之一)引发的三大范式变革:测试对象从“静态”走向“自进化”,质量职能从下游上移至架构层,人机分工转向“定义目标+验收结果”。下一站,是成为敏感、善思、长期主义的质量架构师。
- 本文实测DeepSeek Harness(dsh)在测试开发五环节中的实际替代能力:需求解析(50%)、用例设计(70%)、脚本编写(60%)、执行调度(30%)、缺陷定位(40%),加权综合替代度约50%-67%。AI擅重复劳动,不代判断力。 本文实测DeepSeek Harness(dsh)在测试开发五环节中的实际替代能力:需求解析(50%)、用例设计(70%)、脚本编写(60%)、执行调度(30%)、缺陷定位(40%),加权综合替代度约50%-67%。AI擅重复劳动,不代判断力。
- 本文详解大模型接口三大边界问题:输入上下文溢出、输出max_tokens截断、计费token统计偏差。结合两起400错误实战案例,给出可落地的边界测试方法、代码用例与工程规范,助你直击AI测试面试核心考点。 本文详解大模型接口三大边界问题:输入上下文溢出、输出max_tokens截断、计费token统计偏差。结合两起400错误实战案例,给出可落地的边界测试方法、代码用例与工程规范,助你直击AI测试面试核心考点。
上滑加载中
推荐直播
-
华为云码道Agent集成与鸿蒙实战2026/08/11 周二 19:00-21:00
王一男-华为云码道产品规划专家;李炎-华为云码道产品专家;彭江敏-华为云鸿蒙端云一体化开发专家
本次直播带你解读华为云码道7月份产品新特性、新功能。更有专家演示码道Agent Space × 钉钉机器集成实战,从0到1打通消息通道;码道鸿蒙端云一体化实战,快速搭建员工签到系统。
回顾中 -
华为云开发者AI素养直播课·第五期2026/09/04 周五 16:00-18:00
林华鼎-华为云AI开发者运营负责人;蒋春阳-华为云AI开发者案例开发专家
本期直播内容: AI工具体验营 · 第5-8课连讲。Agent-Team 多智能体协作完成毕业设计实践
回顾中 -
华为云开发者AI素养ClassRoom·第六期2026/09/08 周二 19:00-20:00
樊渊-2026华为软件挑战赛冠军
高手来了:看软挑高手解析二维排样问题—从工业难题到算法突破
回顾中
热门标签