minimal-run-and-audit

minimal-run-and-audit

热门

严谨运行技能,用于README优先的深度学习仓库复现。当任务专门用于从选定的冒烟测试或文档化的推理或评估命令中捕获或规范化证据,并编写标准化的`repro_outputs/`文件(包括仓库文件更改时的补丁说明)时使用。不用于训练执行、初始仓库导入、通用环境设置、论文查找、目标选择、隐藏的科学意义更改或端到端编排。

449Star
9Fork
更新于 2026/6/22
SKILL.md
只读
名称
minimal-run-and-audit
描述

严谨运行技能,用于README优先的深度学习仓库复现。当任务专门用于从选定的冒烟测试或文档化的推理或评估命令中捕获或规范化证据,并编写标准化的`repro_outputs/`文件(包括仓库文件更改时的补丁说明)时使用。不用于训练执行、初始仓库导入、通用环境设置、论文查找、目标选择、隐藏的科学意义更改或端到端编排。

minimal-run-and-audit

将此用作严谨运行技能。安装的slug保持为minimal-run-and-audit以保持兼容性。

使用../../references/agent-operating-principles.md中的共享操作原则;此技能应使运行证据可审计,而无需将每个命令变成僵化的协议。

何时应用

  • 在复现目标和设置计划已存在之后。
  • 当主技能需要执行证据和规范化输出时。
  • 当冒烟测试、文档化的推理运行、文档化的评估运行或其他短的非训练验证合适时。
  • 当用户已经知道应尝试哪个命令,且仅需执行和报告时。

何时不应用

  • 在初始仓库扫描期间。
  • 当环境或资产仍不够明确,使执行无意义时。
  • 当任务是文献查找而非仓库执行时。
  • 当用户仍在决定哪个复现目标应作为主要运行时。

明确边界

  • 此技能负责尝试命令的规范化报告。
  • 它可能从主技能或轻量辅助工具接收执行证据。
  • 它不自行选择整体目标。
  • 它不进行广泛的论文分析。
  • 它不负责训练启动、恢复或长时间运行的训练状态。
  • 它不应将有风险的代码编辑规范化为可接受的做法。
  • 它不得隐藏改变评估、预处理、检查点、指标或其他科学意义的更改。

输入期望

  • 选定的复现目标
  • 可运行的命令或冒烟命令
  • 环境和资产假设
  • 可选的补丁元数据

输出期望

  • 执行结果摘要
  • 标准化的repro_outputs/文件
  • 用于更改的科学意义和证据状态的SCIENTIFIC_CHANGELOG.md
  • 用于README/论文/基线可比性的COMPARABILITY_REPORT.md
  • 已验证、部分和阻塞状态之间的明确区分
  • 当仓库文件更改时的PATCHES.md

备注

使用references/reporting-policy.md../../references/research-rigor-principles.mdscripts/run_command.pyscripts/write_outputs.py