当需要把测试集成到 CI/CD 流水线中、或者现有流水线的测试环节跑起来效率低不可靠时使用此技能。覆盖流水线各阶段的分层测试卡点设计(提交检查→单元测试→接口测试→UI 测试→回归测试)、工具集成策略和质量门禁配置。不要在 CI 里堆满慢的 UI 测试——而是构建测试金字塔:提交阶段跑最快的(<5min),合码阶段跑核心的(<15min),夜间跑全量的。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills
Design & media
AI测试工程师
Try itAI测试工程师全生命周期技能集合。覆盖需求分析→测试设计→AI协作→自动化→执行监控→质量度量→专项测试7大阶段共48个专家级测试技能模块,使初级测试人员输出专家级测试用例。触发词:测试用例、测试设计、测试策略、测试分析、测试报告、接口测试、性能测试、安全测试、自动化测试、AI测试、质量度量、缺陷分析、回归测试、...
What it does
AI测试工程师全生命周期技能集合。覆盖需求分析→测试设计→AI协作→自动化→执行监控→质量度量→专项测试7大阶段共48个专家级测试技能模块,使初级测试人员输出专家级测试用例。触发词:测试用例、测试设计、测试策略、测试分析、测试报告、接口测试、性能测试、安全测试、自动化测试、AI测试、质量度量、缺陷分析、回归测试、兼容性测试、测试评审、测试估算、探索性测试、CI/CD测试、测试数据、测试环境、测试覆盖率、测试效率、质量模型、测试ROI。
The skill document
AI测试工程师 — 48模块全生命周期测试技能集
概述
本Skill将一名初级测试工程师的日常操作注入专家级知识体系,覆盖测试全生命周期的7大阶段48个核心技能模块。每个模块包含核心方法论、专家操作流程、关键检查点、常见陷阱、产出模板和AI增强技巧。
触发指南
当用户提出以下意图时加载本Skill:
- 编写/设计/评审测试用例
- 制定测试策略/计划
- 分析需求可测性
- 执行测试设计(等价类、边界值、状态迁移等)
- AI辅助测试(生成用例、分析缺陷、智能回归)
- 搭建自动化测试框架
- 测试执行监控与缺陷管理
- 质量度量、效率分析、ROI评估
- 专项测试(性能、安全、兼容性、易用性)
架构总览:7阶段 × 48模块
Phase 1: 需求分析与测试策略 (6模块) → references/phase1-requirements.md
Phase 2: 测试设计方法 (8模块) → references/phase2-design-methods.md
Phase 3: 测试用例工程 (8模块) → references/phase3-testcase-engineering.md
Phase 4: AI协作测试 (8模块) → references/phase4-ai-collaboration.md
Phase 5: 自动化测试 (6模块) → references/phase5-automation.md
Phase 6: 测试执行与监控 (6模块) → references/phase6-execution.md
Phase 7: 质量度量与分析 (6模块) → references/phase7-quality-metrics.md
使用方式
交互式导航
当用户提出测试相关问题时,按以下步骤响应:
- 识别阶段:根据用户意图匹配对应的Phase
- 加载参考:Read对应的
references/phaseX-xxx.md文件 - 定位模块:在参考文件中找到精确匹配的技能模块
- 执行专家流程:严格按照模块中定义的方法论、检查点、模板执行
- 输出专家级产物:生成结构化的测试用例/策略/报告
模块选择决策树
用户意图
├─ 涉及需求/策略/计划 → Phase 1
├─ 涉及测试方法/设计技巧 → Phase 2
├─ 涉及具体用例编写 → Phase 3
├─ 涉及AI辅助/智能化 → Phase 4
├─ 涉及自动化/CI/CD → Phase 5
├─ 涉及执行/缺陷/环境 → Phase 6
└─ 涉及度量/效率/ROI → Phase 7
跨阶段组合
对于复杂请求(如"为这个API设计完整的测试方案"),按顺序加载多个Phase:
- Phase 1 → 分析需求可测性,制定测试策略
- Phase 2 → 选择测试设计方法(等价类+边界值+判定表)
- Phase 3 → 编写具体测试用例
- Phase 5 → 设计自动化测试方案(如适用)
- Phase 7 → 定义质量度量标准
快速索引:48模块一览
| 编号 | 模块名称 | 阶段 | 核心价值 |
|---|---|---|---|
| M01 | 需求可测性分析 | P1 | 判断需求是否可测,识别测试盲区 |
| M02 | 测试策略制定 | P1 | 选择最优测试方法和资源分配方案 |
| M03 | 测试范围与优先级 | P1 | 基于风险的测试范围裁剪 |
| M04 | 风险识别与评估 | P1 | FMEA风险矩阵,预防性测试 |
| M05 | 测试估算与资源规划 | P1 | 工作量估算、人力和环境规划 |
| M06 | 需求评审检查清单 | P1 | 结构化需求评审,减少返工 |
| M07 | 等价类划分法 | P2 | 用最少用例覆盖最多场景 |
| M08 | 边界值分析法 | P2 | 精准捕获边界缺陷 |
| M09 | 判定表与因果图 | P2 | 复杂业务规则的逻辑化测试 |
| M10 | 状态迁移测试 | P2 | 全覆盖状态机和状态转换 |
| M11 | 正交实验设计 | P2 | 多因素组合的最小用例集 |
| M12 | 场景法测试设计 | P2 | 端到端用户场景覆盖 |
| M13 | 组合测试设计 | P2 | Pairwise/N-wise组合覆盖 |
| M14 | 错误推测法 | P2 | 基于经验的缺陷预测 |
| M15 | 功能测试用例编写 | P3 | 8要素标准功能用例模板 |
| M16 | 接口测试用例编写 | P3 | REST/GraphQL/gRPC全覆盖 |
| M17 | 性能测试用例设计 | P3 | 负载/压力/稳定性/峰值场景 |
| M18 | 安全测试用例设计 | P3 | OWASP Top 10全覆盖 |
| M19 | 兼容性测试用例 | P3 | 多端多浏览器多分辨率矩阵 |
| M20 | 易用性测试用例 | P3 | Nielsen十大可用性原则驱动 |
| M21 | 测试数据构造 | P3 | 等价类数据+边界数据+异常数据 |
| M22 | 测试用例评审与优化 | P3 | 7维度评审,去除冗余 |
| M23 | AI生成测试用例 | P4 | Prompt工程驱动的高质量用例生成 |
| M24 | AI辅助测试脚本 | P4 | 自然语言→自动化脚本 |
| M25 | AI缺陷分析 | P4 | 智能分类、根因分析、模式识别 |
| M26 | 智能回归测试选择 | P4 | 基于代码变更的精准回归 |
| M27 | AI测试数据生成 | P4 | 智能造数,覆盖边界和异常 |
| M28 | 自然语言用例转换 | P4 | 人类语言→结构化用例 |
| M29 | AI测试覆盖率分析 | P4 | 智能识别未覆盖路径 |
| M30 | AI辅助测试报告 | P4 | 自动汇总、趋势分析、洞察生成 |
| M31 | 自动化框架搭建 | P5 | 选型→架构→脚手架→CI集成 |
| M32 | UI自动化测试 | P5 | Page Object + 智能等待 + 截图 |
| M33 | 接口自动化测试 | P5 | 契约测试+数据驱动+断言链 |
| M34 | CI/CD测试集成 | P5 | Pipeline设计+质量门禁+并行策略 |
| M35 | 自动化脚本维护 | P5 | 自愈定位器+参数化+模块化 |
| M36 | 自动化执行与调度 | P5 | 分布式执行+重试机制+资源管理 |
| M37 | 测试环境管理 | P6 | 环境配置即代码+数据隔离+健康检查 |
| M38 | 探索性测试 | P6 | SBTM+测程+Charter驱动的专家探索 |
| M39 | 测试进度跟踪 | P6 | 燃尽图+进度偏差+风险预警 |
| M40 | 缺陷生命周期管理 | P6 | 提交→确认→修复→验证→关闭 |
| M41 | 回归测试策略 | P6 | 全量/选择/优先级三级回归 |
| M42 | 测试执行风险监控 | P6 | 实时风险信号+预案触发 |
| M43 | 测试覆盖率度量 | P7 | 代码/需求/风险/业务四维覆盖率 |
| M44 | 缺陷密度与趋势分析 | P7 | DDP/缺陷注入率/收敛趋势 |
| M45 | 测试效率度量 | P7 | 用例生产率/执行效率/自动化ROI |
| M46 | 质量模型评估 | P7 | ISO 25010八维质量特性评估 |
| M47 | 测试ROI分析 | P7 | 缺陷预防价值/自动化节省/投入产出比 |
| M48 | 质量仪表盘设计 | P7 | 实时可视化+趋势预测+决策建议 |
专家级核心原则
测试用例8要素标准
每个测试用例必须包含:
- 用例编号(分层编号:模块-场景-序号)
- 测试标题(动词开头,明确验证点)
- 前置条件(数据+环境+权限+状态)
- 测试步骤(操作→预期反应,一步一验证)
- 预期结果(可量化、可验证、不含歧义)
- 测试数据(具体值,非"有效数据")
- 优先级(P0阻塞/P1高/P2中/P3低)
- 关联需求(需求ID+版本)
测试设计五问法(5-Why for Testing)
每个测试设计决策自问:
- 为什么这个场景需要测?(业务影响)
- 为什么选择这个方法?(方法适配性)
- 为什么不测其他场景?(风险可接受性)
- 为什么这个数据?(数据代表性)
- 为什么这个优先级?(失败后果评估)
AI增强三原则
- AI是加速器,不是替代者:AI生成后必须人工审查关键业务逻辑
- Prompt决定质量:输入越结构化,输出越精准
- 增量验证:不要一次性让AI生成全部,分批验证后迭代
技能使用脚本
testcase_generator.py
自动生成标准化测试用例模板。
quality_dashboard.html
交互式质量仪表盘模板。
Related skills
将前面所有分析步骤(需求解构、场景树、边界清单、风险评估等)打包成一个结构化的AI上下文包,确保AI在生成测试用例时拥有完整的业务上下文、功能上下文和技术上下文。当已经完成了需求分析、场景构建和深度设计,即将进入提示词生成阶段时,必须经过此步骤。上下文包的完整度直接决定了AI生成用例的质量——输入垃圾,输出也是垃圾。当上游分析缺失时,本技能会读取用户上传的需求文件或fetch用户提供的URL以补充上下文,并对原始描述做结构化解析后并入上下文包,但不会替代上游分析步骤——缺失项仍需标注并建议回退补充。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills
当需要测试 AI Agent(智能体、聊天机器人、AI 助手)时使用此技能。Agent 测试和传统功能测试完全不同——你要测的不是"点按钮看结果",而是它的推理链路、工具调用时机、幻觉率、Prompt 注入防护、角色边界保持和记忆一致性。如果 Agent 能乱调用工具或泄漏系统 Prompt,那就是安全事件。⚠️ Agent 测试必须包含功能安全可控可靠九维覆盖,缺一不可。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills
根据不同的测试目标和上下文,选择最佳的提示词模式来驱动AI生成高质量的测试用例。当AI输出的测试用例质量不够好、太泛泛、或者深度不够时,问题往往不在AI而在提示词。此技能提供结构化提示词模板,注入前面步骤产出的分析结果,输出包含角色定义、输出格式规范和约束条件的优化提示词。⚠️ 作为工作流的必过步骤,不得跳过。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills
对AI生成的测试用例进行八维评审(完整性、正确性、可执行性、风险覆盖、规范性、一致性、追溯性、冗余度),是AI生成用例后的第一个质量门禁。当AI刚刚生成了一大批测试用例、你需要确保这些用例真的有价值而不是"看起来不错"时,应当使用此技能。不要假设AI输出的都是对的——AI经常生成语义正确但实际操作不了的用例。每个维度评分低于7分的必须标注问题并使用MISSING/WRONG/VAGUE等规范格式标记。无上游场景树/风险清单时降级为六维评审(跳过追溯性、简化完整性)。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills
当需要测试 RESTful/GraphQL/gRPC/WebSocket 等 API 时使用此技能。覆盖接口的功能验证、参数组合、鉴权绕过、超时重试、幂等性、接口契约和向后兼容性。不要只测 HTTP 状态码——真正的接口 Bug 往往在数据结构不一致、字段类型不匹配、空值处理和并发调用上。输出接口测试矩阵、契约断言清单和工具选型建议。 本技能属于 QA Test Skills 技能集(49 个技能之一),完整工作流体验需安装全套:npx skills add Kokxi/qa-test-skills