SKILL.md
readonly只读
name
minimal-run-and-audit
description
严谨运行技能,用于遵循README优先的深度学习仓库复现。当任务专门用于捕获或规范化所选冒烟测试或文档化推理/评估命令的证据,并编写标准化的 `repro_outputs/` 文件(包括仓库文件变更时的补丁说明)时使用。不用于训练执行、初始仓库导入、通用环境设置、论文查找、目标选择、隐藏的科学意义变更或端到端编排。
minimal-run-and-audit
将此用作严谨运行技能。安装的slug保持为 minimal-run-and-audit 以保持兼容性。
使用 ../../references/agent-operating-principles.md 中的共享操作原则;此技能应使运行证据可审计,而无需将每个命令变成僵化的协议。
何时应用
- 在复现目标和设置计划已存在之后。
- 当主技能需要执行证据和规范化输出时。
- 当冒烟测试、文档化推理运行、文档化评估运行或其他短的非训练验证合适时。
- 当用户已知应尝试的命令,且仅需执行和报告时。
何时不应用
- 在初始仓库扫描期间。
- 当环境或资产仍不够明确,使执行无意义时。
- 当任务是文献查找而非仓库执行时。
- 当用户仍在决定哪个复现目标应作为主要运行时。
明确边界
- 此技能负责对尝试的命令进行规范化报告。
- 它可能从主技能或轻量辅助工具接收执行证据。
- 它不自行选择整体目标。
- 它不进行广泛的论文分析。
- 它不负责训练启动、恢复或长时间运行的训练状态。
- 它不应将风险代码编辑规范化为可接受的做法。
- 它不得隐藏改变评估、预处理、检查点、指标或其他科学意义的变更。
输入期望
- 选定的复现目标
- 可运行的命令或冒烟命令
- 环境和资产假设
- 可选的补丁元数据
输出期望
- 执行结果摘要
- 标准化的
repro_outputs/文件 - 用于变更的科学意义和证据状态的
SCIENTIFIC_CHANGELOG.md - 用于README/论文/基线可比性的
COMPARABILITY_REPORT.md - 已验证、部分和阻塞状态之间的清晰区分
- 当仓库文件变更时的
PATCHES.md
备注
使用 references/reporting-policy.md、../../references/research-rigor-principles.md、scripts/run_command.py 和 scripts/write_outputs.py。






