AGENT SKILLS 目录

代码审查与测试 Agent Skills

查找可用于检查变更、设计测试、质疑假设并在交付前验证软件工作的 Skills。

33
已收录 Skills
20
Top 100 条目
3
原生 Agent 信号

适合的工作

先从目标开始

  1. 01审查代码与架构决策
  2. 02生成并维护聚焦测试
  3. 03为开发交接补充可核对证据

选择检查

安装前缩小范围

  1. 01确认 Skill 可以访问哪些文件和命令。
  2. 02区分只提供审查建议和能够直接修改代码的工具。
  3. 03第一次测试应在临时分支或隔离工作区中完成。

完整分类

代码审查与测试

按 SkillSignal 的公开元数据信号排序。分数不等于安全认证,安装前请打开完整资料。

0196

frontend-design

Frontend Design 是 Anthropic 面向差异化生产界面的设计与实现指南。

主要局限
审美判断具有主观性,仍需要利益相关方评审。
首要风险
形式压过功能 ·
来源
固定提交 · 0a64e398
查看完整资料
0294

web-design-guidelines

Web Design Guidelines 是 Vercel 的聚焦界面审查工作流。

主要局限
它依赖网络和会随时间变化的实时规范文档。
首要风险
规则漂移或脱离上下文的结论 ·
来源
固定提交 · b8caa260
查看完整资料
0394

mcp-builder

MCP Builder 是 Anthropic 面向 Python 或 TypeScript 高质量 Model Context Protocol 服务器的开发指南。

主要局限
该指南不能替代最新 MCP SDK 或目标 API 文档。
首要风险
外部服务工具权限过大 ·
来源
固定提交 · 0a64e398
查看完整资料
0494

skill-creator

Skill Creator 是 Anthropic 用于创建、改进和评测 Agent Skill 的端到端流程。

主要局限
有意义的基准需要代表性提示、多次运行和谨慎人工判断。
首要风险
不可信评测提示与产物 ·
来源
固定提交 · 0a64e398
查看完整资料
0593

grill-me

Grill Me 是在实施前压力测试方案、设计或架构的结构化访谈流程。

主要局限
持续追问可能令人疲劳,也不适合小型、可快速撤销的决策。
首要风险
决策疲劳 ·
来源
固定提交 · 885e2ca4
查看完整资料
0693

codeql

CodeQL 是 Trail of Bits 面向八类语言的跨过程安全分析流程。

主要局限
需要 CodeQL、jq、uv、可构建目标,数据库构建也可能耗时较长。
首要风险
构建与扫描副作用 ·
来源
固定提交 · 9b281335
查看完整资料
0793

semgrep

Semgrep 是 Trail of Bits 的审批式安全扫描流程。

主要局限
需要 Semgrep,并可能联网获取注册表或第三方规则;Pro 专属跨文件分析可能不可用。
首要风险
第三方规则与源码暴露 ·
来源
固定提交 · 9b281335
查看完整资料
0893

differential-review

Differential Review 是 Trail of Bits 面向拉取请求、提交和差异的风险优先安全评审。

主要局限
不适合全新代码或广泛的初始漏洞发现。
首要风险
上下文不完整造成虚假信心 ·
来源
固定提交 · 9b281335
查看完整资料
0993

autoresearch

Autoresearch 是 GitHub Awesome Copilot 中面向指标驱动自主编程实验的流程。

主要局限
只适合拥有稳定且有代表性数值指标的任务。
首要风险
自主修改仓库 ·
来源
固定提交 · 318066d2
查看完整资料
1093

anti-ui-slop

Anti UI Slop 是 GitHub Awesome Copilot 中让 Web 与 iOS 界面真正属于具体产品的流程。

主要局限
需要访问仓库,并最好能够查看 UIZZE 参考或用户提供的截图。
首要风险
过度照搬外部界面 ·
来源
固定提交 · 318066d2
查看完整资料
1193

bigquery-pipeline-audit

BigQuery Pipeline Audit 是 GitHub Awesome Copilot 中审查 Python 与 BigQuery 管线的代码流程,检查任务数量、计费字节上限、试运行、回填循环、分区裁剪、连接膨胀、幂等写入和失败可观测性,并返回精确修改位置。

主要局限
专用于 Python 与 BigQuery,不能验证实时项目配置或账单账户。
首要风险
审计估算被当作账单保证 ·
来源
固定提交 · 318066d2
查看完整资料
1292

variant-analysis

Variant Analysis 是 Trail of Bits 用于寻找已知缺陷根因其他表现形式的五步流程。

主要局限
必须已有一个经过验证的缺陷;它不是初始发现流程。
首要风险
自动匹配范围过宽 ·
来源
固定提交 · 9b281335
查看完整资料
1392

web-design-reviewer

Web Design Reviewer 是 GitHub Awesome Copilot 中检查运行中网站的流程,覆盖手机、平板、桌面和宽屏视口,定位源码中的设计问题,进行最小修复并重新验证。

主要局限
需要运行中的目标、浏览器自动化,以及修复时的源码访问。
首要风险
远程审查中的意外改动 ·
来源
固定提交 · 318066d2
查看完整资料
1492

create-implementation-plan

Create Implementation Plan 是 GitHub Awesome Copilot 面向确定性、机器可读执行计划的模板。

主要局限
要求零歧义可能让探索性工作产生过大计划或虚假精确。
首要风险
生成细节造成虚假确定性 ·
来源
固定提交 · 318066d2
查看完整资料
1592

create-technical-spike

Create Technical Spike 是 GitHub Awesome Copilot 中隔离一个关键技术未知项的模板,为其指定时间盒和责任人,规划研究与原型,记录证据,并以建议和后续行动收尾。

主要局限
提供的是文档结构,不能证明实验具有代表性或完整性。
首要风险
原型工作影响真实系统 ·
来源
固定提交 · 318066d2
查看完整资料
1691

tdd

TDD 是 Matt Pocock 面向行为测试的红—绿—重构参考流程。

主要局限
该流程需要可用的测试运行器和清晰的公共行为。
首要风险
错误信心 ·
来源
固定提交 · 885e2ca4
查看完整资料
1791

context-map

Context Map 是 GitHub Awesome Copilot 中在修改代码前识别待改文件、直接依赖、受影响测试、参考模式与实施风险的轻量流程。

主要局限
该流程刻意简短,可能遗漏动态依赖或运行时责任边界。
首要风险
不完整映射被视为全部范围 ·
来源
固定提交 · 318066d2
查看完整资料
1890

find-skills

Find Skills 是 Vercel 提供的 Agent Skill 发现流程。

主要局限
发现质量取决于 skills.sh 的收录范围与网络可用性。
首要风险
未经审查的安装 ·
来源
固定提交 · 435076e7
查看完整资料
1990

vercel-react-best-practices

Vercel React Best Practices 是 Vercel 维护的 React 与 Next.js 性能指南。

主要局限
规则需要结合应用的 React、Next.js 与部署版本解释。
首要风险
脱离上下文的优化 ·
来源
固定提交 · b8caa260
查看完整资料
2086

improve-codebase-architecture

Improve Codebase Architecture 用于发现架构摩擦,并提出接口更小、实现更深的模块方案。

主要局限
架构判断依赖变更历史与领域上下文,而这些信息可能不完整。
首要风险
过早重构 ·
来源
固定提交 · 885e2ca4
查看完整资料
2186

setup-matt-pocock-skills

Setup Matt Pocock Skills 是一组工程工作流的仓库配置脚手架。

主要局限
输出面向 Matt Pocock 的 Skill 系列,并非通用标准。
首要风险
仓库配置变更 ·
来源
固定提交 · 885e2ca4
查看完整资料
2286

handoff

Handoff 把当前对话压缩为供新 Agent 继续工作的交接文档。

主要局限
压缩可能遗漏原始对话中的重要细节。
首要风险
敏感上下文泄露 ·
来源
固定提交 · 885e2ca4
查看完整资料
2386

triage

Triage 通过一套小型、已配置的状态机推进项目 Issue。

主要局限
该流程需要正确配置跟踪器操作与标签词汇。
首要风险
外部跟踪器变更 ·
来源
固定提交 · 885e2ca4
查看完整资料
2486

prototype

Prototype 用一次性代码回答一个设计或逻辑问题。

主要局限
原型代码有意省略生产加固、持久化与广泛边界情况。
首要风险
原型误入生产 ·
来源
固定提交 · 885e2ca4
查看完整资料
2585

teach

Teach 把当前目录变成面向单一主题、跨多次会话持续使用的学习工作区。

主要局限
它用于持续学习项目,不适合一次性解释或即时答案。
首要风险
不可信教学来源或非预期工作区写入 ·
来源
固定提交 · 885e2ca4
查看完整资料
2685

grilling

Grilling 把计划、决策或想法建模为带依赖关系的设计树进行压力测试。

主要局限
它会刻意推迟实施,直到决策树完成并得到明确确认。
首要风险
决策疲劳或推荐锚定 ·
来源
固定提交 · 885e2ca4
查看完整资料
2785

caveman

Caveman 是一种可持续启用的回复压缩模式,提供 lite、full、ultra 及文言变体。

主要局限
压缩可能遗漏原始对话中重要的细微差别、歧义或理由。
首要风险
压缩隐藏关键细节 ·
来源
固定提交 · 702da5ce
查看完整资料
2885

domain-modeling

Domain Modeling 把代码库的通用语言变成持续维护的工程产物。

主要局限
它记录语言与决策,不能替代实现设计或领域专家验证。
首要风险
固化错误领域模型 ·
来源
固定提交 · 885e2ca4
查看完整资料
2985

repo-intake-and-plan

Repo Intake and Plan 是面向科研代码仓库的 README 优先助手。

主要局限
它不创建环境、下载资源、执行命令、检索论文或撰写最终报告。
首要风险
依据不完整仓库证据规划 ·
来源
固定提交 · 3ab50525
查看完整资料
3085

minimal-run-and-audit

Minimal Run and Audit 为科研代码执行已选定的冒烟、推理、评估或其他短时非训练验证。

主要局限
它不选择复现目标、不训练模型、不做广泛论文分析,也不会隐藏改变科学意义的修改。
首要风险
把科学性变更隐藏为搭建修复 ·
来源
固定提交 · 3ab50525
查看完整资料
3185

env-and-assets-bootstrap

Environment and Assets Bootstrap 在科研复现目标已选定后,准备保守、Conda 优先的环境与资源计划。

主要局限
它假设目标已选定,不负责仓库接收或论文解释。
首要风险
不可信资源或不可复现依赖 ·
来源
固定提交 · 3ab50525
查看完整资料
3285

codebase-design

Codebase Design 为审查模块、接口、接缝、适配器、杠杆率、局部性与可测试性提供统一词汇。

主要局限
这些词汇有助于批评设计,但不会自动产出正确架构。
首要风险
过早抽象 ·
来源
固定提交 · 885e2ca4
查看完整资料
3385

diagnosing-bugs

Diagnosing Bugs 是面向棘手缺陷与性能回归的证据优先循环。

主要局限
它需要可重复的通过/失败信号;仅在生产间歇出现的问题可能先需要可观测性或人工证据。
首要风险
诊断证据泄露机密 ·
来源
固定提交 · 885e2ca4
查看完整资料