minimal-run-and-audit

minimal-run-and-audit

热门

严谨运行技能,用于遵循README优先的深度学习仓库复现。当任务专门用于捕获或规范化所选冒烟测试或文档化推理/评估命令的证据,并编写标准化的 `repro_outputs/` 文件(包括仓库文件变更时的补丁说明)时使用。不用于训练执行、初始仓库导入、通用环境设置、论文查找、目标选择、隐藏的科学意义变更或端到端编排。

413Star
9Fork
更新于 2026/6/16
SKILL.md
readonly只读
name
minimal-run-and-audit
description

严谨运行技能,用于遵循README优先的深度学习仓库复现。当任务专门用于捕获或规范化所选冒烟测试或文档化推理/评估命令的证据,并编写标准化的 `repro_outputs/` 文件(包括仓库文件变更时的补丁说明)时使用。不用于训练执行、初始仓库导入、通用环境设置、论文查找、目标选择、隐藏的科学意义变更或端到端编排。

minimal-run-and-audit

将此用作严谨运行技能。安装的slug保持为 minimal-run-and-audit 以保持兼容性。

使用 ../../references/agent-operating-principles.md 中的共享操作原则;此技能应使运行证据可审计,而无需将每个命令变成僵化的协议。

何时应用

  • 在复现目标和设置计划已存在之后。
  • 当主技能需要执行证据和规范化输出时。
  • 当冒烟测试、文档化推理运行、文档化评估运行或其他短的非训练验证合适时。
  • 当用户已知应尝试的命令,且仅需执行和报告时。

何时不应用

  • 在初始仓库扫描期间。
  • 当环境或资产仍不够明确,使执行无意义时。
  • 当任务是文献查找而非仓库执行时。
  • 当用户仍在决定哪个复现目标应作为主要运行时。

明确边界

  • 此技能负责对尝试的命令进行规范化报告。
  • 它可能从主技能或轻量辅助工具接收执行证据。
  • 它不自行选择整体目标。
  • 它不进行广泛的论文分析。
  • 它不负责训练启动、恢复或长时间运行的训练状态。
  • 它不应将风险代码编辑规范化为可接受的做法。
  • 它不得隐藏改变评估、预处理、检查点、指标或其他科学意义的变更。

输入期望

  • 选定的复现目标
  • 可运行的命令或冒烟命令
  • 环境和资产假设
  • 可选的补丁元数据

输出期望

  • 执行结果摘要
  • 标准化的 repro_outputs/ 文件
  • 用于变更的科学意义和证据状态的 SCIENTIFIC_CHANGELOG.md
  • 用于README/论文/基线可比性的 COMPARABILITY_REPORT.md
  • 已验证、部分和阻塞状态之间的清晰区分
  • 当仓库文件变更时的 PATCHES.md

备注

使用 references/reporting-policy.md../../references/research-rigor-principles.mdscripts/run_command.pyscripts/write_outputs.py