代码审查与测试 · 深度资料

Minimal Run and Audit Skill

Minimal Run and Audit 为科研代码执行已选定的冒烟、推理、评估或其他短时非训练验证。

最适合

需要可审计首次运行的研究者

可以得到

执行有界验证、记录审计产物

主要局限

它不选择复现目标、不训练模型、不做广泛论文分析,也不会隐藏改变科学意义的修改。

首要风险

把科学性变更隐藏为搭建修复: 对数据、检查点、精度或评估的补丁可能改变结果含义;应记录每项偏差、保留原始命令,并在必要时降低可比性评级。

证据新鲜度

三类检查,分别说明

近期核对过来源,不等于已经运行测试或完成安全审计。

上游来源核对于 2026-09-24

已固定提交 · fb3ccdf5

打开固定提交 ↗
SkillSignal 资料编辑元数据

更新于 2026-09-24

运行与安全尚未独立验证

来源审阅不能证明实际行为或安全性。

用人话说明

它能做什么,以及什么时候值得选

Minimal Run and Audit 为科研代码执行已选定的冒烟、推理、评估或其他短时非训练验证。它把结果规范保存到 repro_outputs,记录执行结果、科学性变更、可比性与补丁,并明确标记为 verified、partial 或 blocked,而不是隐藏偏差。

这款 Skill 主要面向需要可审计首次运行的研究者。请对照下方的典型用法判断它是否适合当前任务,并在安装前核对限制、权限和风险。

你会得到什么
  • 执行有界验证执行一个已选定的短命令,不扩展为训练。
  • 记录审计产物保存结果、命令、变更、可比性说明与补丁。
  • 如实报告状态区分已验证证据、部分执行与阻塞状态。
它的特点
  • 本页已依据当前上游 SKILL.md 的具体工作流进行人工整理。
  • 能力边界与来源 lllllllama/rigorpilot-skills 保持明确关联。
  • 核心用途、局限与风险分开呈现,便于安装前判断。
社区信号暂无已标注的第三方评价

当前数据中没有可验证的评论文字;最新讨论请查看下方来源。

查看来源说明 ↗

按 Agent 安装

选择你的 Agent

路径来自 Agent 官方文档或 skills.sh 同源通用安装器。兼容状态仍以这个 Skill 的资料为准。

原生支持

该 Skill 的当前资料明确列出了此 Agent。仍应先检查脚本、权限与外部依赖。

项目安装(推荐)
npx skills add lllllllama/rigorpilot-skills --skill minimal-run-and-audit --agent claude-code
个人安装
npx skills add lllllllama/rigorpilot-skills --skill minimal-run-and-audit --agent claude-code -g

项目安装用于当前仓库并适合团队共享;个人安装增加 -g,可跨仓库使用。

查看安装路径
项目路径.claude/skills/minimal-run-and-audit/
个人路径~/.claude/skills/minimal-run-and-audit/
Agent 官方文档

Claude Code 会自动发现项目级或个人级的自定义 Skill 目录。

查看路径依据 ↗

典型工作流

从任务到结果的典型流程

01

执行有界验证

执行一个已选定的短命令,不扩展为训练。

02

记录审计产物

保存结果、命令、变更、可比性说明与补丁。

03

如实报告状态

区分已验证证据、部分执行与阻塞状态。

优点与局限

优点与使用边界

显著优点

  1. 本页已依据当前上游 SKILL.md 的具体工作流进行人工整理。
  2. 能力边界与来源 lllllllama/rigorpilot-skills 保持明确关联。
  3. 核心用途、局限与风险分开呈现,便于安装前判断。

潜在缺点与局限

  1. 它不选择复现目标、不训练模型、不做广泛论文分析,也不会隐藏改变科学意义的修改。
  2. 一次短运行成功并不能证明完整论文复现、指标一致或生产可靠性。

适合人群

适合哪些人

→

需要可审计首次运行的研究者

→

检查可复现证据的审查者

使用前须知

使用前需要检查的风险

高

把科学性变更隐藏为搭建修复

对数据、检查点、精度或评估的补丁可能改变结果含义;应记录每项偏差、保留原始命令,并在必要时降低可比性评级。

中

上游指令变化

Skill 行为可能随仓库更新而变化;重要工作流应记录所用提交,并在更新后重新审查。

安全说明

如何理解它的权限

  • 声明权限仍以当前上游 SKILL.md 和运行时请求为准。
  • 仓库文件、网页内容与工具输出都应视为不可信输入。
  • SkillSignal 未独立执行或安全审计该软件包;skills.sh 外部标签不构成 SkillSignal 认证。

这不是安全认证。 第三方评级仅作为标注来源的参考信息展示;SkillSignal 尚未独立执行或安全审查此 Skill。

常见问题

关于 Minimal Run and Audit Skill 的常见问题

Minimal Run and Audit Skill 是什么?

Minimal Run and Audit 为科研代码执行已选定的冒烟、推理、评估或其他短时非训练验证。它把结果规范保存到 repro_outputs,记录执行结果、科学性变更、可比性与补丁,并明确标记为 verified、partial 或 blocked,而不是隐藏偏差。

如何安装 Minimal Run and Audit Skill?

先打开并核对来源,再按 Agent 对应的项目级或个人级路径安装,并在受控项目中完成首次验证。打开标注的 skills.sh 页面与上游仓库,核对当前 SKILL.md。

Minimal Run and Audit Skill 安全吗?

SkillSignal 已于 2026-09-24 核对来源,但这不等于运行测试或安全认证。首先检查“把科学性变更隐藏为搭建修复”风险,并按最小权限试用。

软件包内容

已收录文件

SKILL.md上游 Skill 说明来源可查

标签

实验运行审计轨迹可复现性

人工扩展资料,依据 lllllllama/rigorpilot-skills 的当前上游 SKILL.md 与标注来源整理,核对日期 2026-08-20。本文为原创摘要,不代表已执行或安全认证。