任务指南 · 来源透明
Web 应用测试 Agent Skills 执行方案
用于浏览器行为、日志、截图和可重复验收检查的最小 Skill 方案。
为我的 Agent 生成这个方案 ↗仅使用测试数据以及本地或明确获批的环境。
01 · SKILL STACK
最小三角色组合
每个角色只负责一件事。个性化生成器可根据 Agent 调整选择,但不会改变决策逻辑。
playwright-workflows
在浏览器中执行真实用户流程。
- 主要局限
- 详细软件包文件尚未完全编目。
- 首要风险
- 安装前审查
- 来源证据
- 编辑来源
web-design-guidelines
明确范围,避免宽泛且无重点的测试。
- 主要局限
- 它依赖网络和会随时间变化的实时规范文档。
- 首要风险
- 规则漂移或脱离上下文的结论
- 来源证据
- 固定提交 · b8caa260
minimal-run-and-audit
保留视觉与运行证据供复核。
- 主要局限
- 它不选择复现目标、不训练模型、不做广泛论文分析,也不会隐藏改变科学意义的修改。
- 首要风险
- 把科学性变更隐藏为搭建修复
- 来源证据
- 固定提交 · 3ab50525
02 · ACCEPTANCE
如何确认任务完成
- 从干净浏览器状态运行一条关键流程。
- 验证预期页面状态,而不只是点击成功。
- 保存复现缺陷所需的失败信号。
03 · STOP CONDITIONS
什么时候应该停止
- 测试需要生产凭据或个人数据。
- 脚本在未隔离的情况下执行破坏性操作。
- 把不稳定结果报告为通过。
04 · METHOD
这份指南如何生成
SkillSignal 先把明确任务拆分为三个互不重叠的职责,再从已核对的目录元数据中选择候选。Agent 适配、来源状态、权限与公开评分均由确定性规则计算;请求时不调用 LLM 编写或调整推荐顺序。