设计与多媒体

AI测试工程师

试用

AI测试工程师全生命周期技能集合。覆盖需求分析→测试设计→AI协作→自动化→执行监控→质量度量→专项测试7大阶段共48个专家级测试技能模块,使初级测试人员输出专家级测试用例。触发词:测试用例、测试设计、测试策略、测试分析、测试报告、接口测试、性能测试、安全测试、自动化测试、AI测试、质量度量、缺陷分析、回归测试、...

它能做什么

AI测试工程师全生命周期技能集合。覆盖需求分析→测试设计→AI协作→自动化→执行监控→质量度量→专项测试7大阶段共48个专家级测试技能模块,使初级测试人员输出专家级测试用例。触发词:测试用例、测试设计、测试策略、测试分析、测试报告、接口测试、性能测试、安全测试、自动化测试、AI测试、质量度量、缺陷分析、回归测试、兼容性测试、测试评审、测试估算、探索性测试、CI/CD测试、测试数据、测试环境、测试覆盖率、测试效率、质量模型、测试ROI。

技能文档

AI测试工程师 — 48模块全生命周期测试技能集

概述

本Skill将一名初级测试工程师的日常操作注入专家级知识体系,覆盖测试全生命周期的7大阶段48个核心技能模块。每个模块包含核心方法论、专家操作流程、关键检查点、常见陷阱、产出模板和AI增强技巧。

触发指南

当用户提出以下意图时加载本Skill:

  • 编写/设计/评审测试用例
  • 制定测试策略/计划
  • 分析需求可测性
  • 执行测试设计(等价类、边界值、状态迁移等)
  • AI辅助测试(生成用例、分析缺陷、智能回归)
  • 搭建自动化测试框架
  • 测试执行监控与缺陷管理
  • 质量度量、效率分析、ROI评估
  • 专项测试(性能、安全、兼容性、易用性)

架构总览:7阶段 × 48模块

Phase 1: 需求分析与测试策略 (6模块) → references/phase1-requirements.md
Phase 2: 测试设计方法 (8模块)        → references/phase2-design-methods.md
Phase 3: 测试用例工程 (8模块)        → references/phase3-testcase-engineering.md
Phase 4: AI协作测试 (8模块)          → references/phase4-ai-collaboration.md
Phase 5: 自动化测试 (6模块)          → references/phase5-automation.md
Phase 6: 测试执行与监控 (6模块)      → references/phase6-execution.md
Phase 7: 质量度量与分析 (6模块)      → references/phase7-quality-metrics.md

使用方式

交互式导航

当用户提出测试相关问题时,按以下步骤响应:

  1. 识别阶段:根据用户意图匹配对应的Phase
  2. 加载参考:Read对应的 references/phaseX-xxx.md 文件
  3. 定位模块:在参考文件中找到精确匹配的技能模块
  4. 执行专家流程:严格按照模块中定义的方法论、检查点、模板执行
  5. 输出专家级产物:生成结构化的测试用例/策略/报告

模块选择决策树

用户意图
├─ 涉及需求/策略/计划 → Phase 1
├─ 涉及测试方法/设计技巧 → Phase 2
├─ 涉及具体用例编写 → Phase 3
├─ 涉及AI辅助/智能化 → Phase 4
├─ 涉及自动化/CI/CD → Phase 5
├─ 涉及执行/缺陷/环境 → Phase 6
└─ 涉及度量/效率/ROI → Phase 7

跨阶段组合

对于复杂请求(如"为这个API设计完整的测试方案"),按顺序加载多个Phase:

  1. Phase 1 → 分析需求可测性,制定测试策略
  2. Phase 2 → 选择测试设计方法(等价类+边界值+判定表)
  3. Phase 3 → 编写具体测试用例
  4. Phase 5 → 设计自动化测试方案(如适用)
  5. Phase 7 → 定义质量度量标准

快速索引:48模块一览

编号模块名称阶段核心价值
M01需求可测性分析P1判断需求是否可测,识别测试盲区
M02测试策略制定P1选择最优测试方法和资源分配方案
M03测试范围与优先级P1基于风险的测试范围裁剪
M04风险识别与评估P1FMEA风险矩阵,预防性测试
M05测试估算与资源规划P1工作量估算、人力和环境规划
M06需求评审检查清单P1结构化需求评审,减少返工
M07等价类划分法P2用最少用例覆盖最多场景
M08边界值分析法P2精准捕获边界缺陷
M09判定表与因果图P2复杂业务规则的逻辑化测试
M10状态迁移测试P2全覆盖状态机和状态转换
M11正交实验设计P2多因素组合的最小用例集
M12场景法测试设计P2端到端用户场景覆盖
M13组合测试设计P2Pairwise/N-wise组合覆盖
M14错误推测法P2基于经验的缺陷预测
M15功能测试用例编写P38要素标准功能用例模板
M16接口测试用例编写P3REST/GraphQL/gRPC全覆盖
M17性能测试用例设计P3负载/压力/稳定性/峰值场景
M18安全测试用例设计P3OWASP Top 10全覆盖
M19兼容性测试用例P3多端多浏览器多分辨率矩阵
M20易用性测试用例P3Nielsen十大可用性原则驱动
M21测试数据构造P3等价类数据+边界数据+异常数据
M22测试用例评审与优化P37维度评审,去除冗余
M23AI生成测试用例P4Prompt工程驱动的高质量用例生成
M24AI辅助测试脚本P4自然语言→自动化脚本
M25AI缺陷分析P4智能分类、根因分析、模式识别
M26智能回归测试选择P4基于代码变更的精准回归
M27AI测试数据生成P4智能造数,覆盖边界和异常
M28自然语言用例转换P4人类语言→结构化用例
M29AI测试覆盖率分析P4智能识别未覆盖路径
M30AI辅助测试报告P4自动汇总、趋势分析、洞察生成
M31自动化框架搭建P5选型→架构→脚手架→CI集成
M32UI自动化测试P5Page Object + 智能等待 + 截图
M33接口自动化测试P5契约测试+数据驱动+断言链
M34CI/CD测试集成P5Pipeline设计+质量门禁+并行策略
M35自动化脚本维护P5自愈定位器+参数化+模块化
M36自动化执行与调度P5分布式执行+重试机制+资源管理
M37测试环境管理P6环境配置即代码+数据隔离+健康检查
M38探索性测试P6SBTM+测程+Charter驱动的专家探索
M39测试进度跟踪P6燃尽图+进度偏差+风险预警
M40缺陷生命周期管理P6提交→确认→修复→验证→关闭
M41回归测试策略P6全量/选择/优先级三级回归
M42测试执行风险监控P6实时风险信号+预案触发
M43测试覆盖率度量P7代码/需求/风险/业务四维覆盖率
M44缺陷密度与趋势分析P7DDP/缺陷注入率/收敛趋势
M45测试效率度量P7用例生产率/执行效率/自动化ROI
M46质量模型评估P7ISO 25010八维质量特性评估
M47测试ROI分析P7缺陷预防价值/自动化节省/投入产出比
M48质量仪表盘设计P7实时可视化+趋势预测+决策建议

专家级核心原则

测试用例8要素标准

每个测试用例必须包含:

  1. 用例编号(分层编号:模块-场景-序号)
  2. 测试标题(动词开头,明确验证点)
  3. 前置条件(数据+环境+权限+状态)
  4. 测试步骤(操作→预期反应,一步一验证)
  5. 预期结果(可量化、可验证、不含歧义)
  6. 测试数据(具体值,非"有效数据")
  7. 优先级(P0阻塞/P1高/P2中/P3低)
  8. 关联需求(需求ID+版本)

测试设计五问法(5-Why for Testing)

每个测试设计决策自问:

  1. 为什么这个场景需要测?(业务影响)
  2. 为什么选择这个方法?(方法适配性)
  3. 为什么不测其他场景?(风险可接受性)
  4. 为什么这个数据?(数据代表性)
  5. 为什么这个优先级?(失败后果评估)

AI增强三原则

  1. AI是加速器,不是替代者:AI生成后必须人工审查关键业务逻辑
  2. Prompt决定质量:输入越结构化,输出越精准
  3. 增量验证:不要一次性让AI生成全部,分批验证后迭代

技能使用脚本

testcase_generator.py

自动生成标准化测试用例模板。

quality_dashboard.html

交互式质量仪表盘模板。

相关技能

当需要把测试集成到 CI/CD 流水线中、或者现有流水线的测试环节跑起来效率低不可靠时使用此技能。覆盖流水线各阶段的分层测试卡点设计(提交检查→单元测试→接口测试→UI 测试→回归测试)、工具集成策略和质量门禁配置。不要在 CI 里堆满慢的 UI 测试——而是构建测试金字塔:提交阶段跑最快的(<5min),合码阶段跑核心的(<15min),夜间跑全量的。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装

将前面所有分析步骤(需求解构、场景树、边界清单、风险评估等)打包成一个结构化的AI上下文包,确保AI在生成测试用例时拥有完整的业务上下文、功能上下文和技术上下文。当已经完成了需求分析、场景构建和深度设计,即将进入提示词生成阶段时,必须经过此步骤。上下文包的完整度直接决定了AI生成用例的质量——输入垃圾,输出也是垃圾。当上游分析缺失时,本技能会读取用户上传的需求文件或fetch用户提供的URL以补充上下文,并对原始描述做结构化解析后并入上下文包,但不会替代上游分析步骤——缺失项仍需标注并建议回退补充。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装

当需要测试 AI Agent(智能体、聊天机器人、AI 助手)时使用此技能。Agent 测试和传统功能测试完全不同——你要测的不是"点按钮看结果",而是它的推理链路、工具调用时机、幻觉率、Prompt 注入防护、角色边界保持和记忆一致性。如果 Agent 能乱调用工具或泄漏系统 Prompt,那就是安全事件。⚠️ Agent 测试必须包含功能安全可控可靠九维覆盖,缺一不可。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装

根据不同的测试目标和上下文,选择最佳的提示词模式来驱动AI生成高质量的测试用例。当AI输出的测试用例质量不够好、太泛泛、或者深度不够时,问题往往不在AI而在提示词。此技能提供结构化提示词模板,注入前面步骤产出的分析结果,输出包含角色定义、输出格式规范和约束条件的优化提示词。⚠️ 作为工作流的必过步骤,不得跳过。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装

对AI生成的测试用例进行八维评审(完整性、正确性、可执行性、风险覆盖、规范性、一致性、追溯性、冗余度),是AI生成用例后的第一个质量门禁。当AI刚刚生成了一大批测试用例、你需要确保这些用例真的有价值而不是"看起来不错"时,应当使用此技能。不要假设AI输出的都是对的——AI经常生成语义正确但实际操作不了的用例。每个维度评分低于7分的必须标注问题并使用MISSING/WRONG/VAGUE等规范格式标记。无上游场景树/风险清单时降级为六维评审(跳过追溯性、简化完整性)。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装

当需要测试 RESTful/GraphQL/gRPC/WebSocket 等 API 时使用此技能。覆盖接口的功能验证、参数组合、鉴权绕过、超时重试、幂等性、接口契约和向后兼容性。不要只测 HTTP 状态码——真正的接口 Bug 往往在数据结构不一致、字段类型不匹配、空值处理和并发调用上。输出接口测试矩阵、契约断言清单和工具选型建议。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills

2 次安装