nature-reader

nature-reader

热门

构建期刊或会议论文的全文中英对照、图表感知、源锚定的Markdown阅读器,支持PDF、DOI、arXiv、出版商HTML或粘贴文本。当用户要求翻译或阅读论文、制作中英文对照/原文对照/全文翻译解读、将图表提取到正确位置、保持图表靠近相关正文、或为每个区块保留精确的源锚点时使用。此技能不得降级为仅摘要输出,除非用户明确要求摘要。同时适用于一般的论文阅读和翻译请求,即使不包含“Nature”一词,例如阅读/翻译学术论文、文献阅读、理解论文,以及中文表述如读论文、精读论文、论文翻译、文献翻译、文献阅读、学术阅读、帮我读这篇文章、翻译这篇paper。

3万Star
1786Fork
更新于 2026/7/22
SKILL.md
readonly只读
name
nature-reader
description

构建期刊或会议论文的全文中英对照、图表感知、源锚定的Markdown阅读器,支持PDF、DOI、arXiv、出版商HTML或粘贴文本。当用户要求翻译或阅读论文、制作中英文对照/原文对照/全文翻译解读、将图表提取到正确位置、保持图表靠近相关正文、或为每个区块保留精确的源锚点时使用。此技能不得降级为仅摘要输出,除非用户明确要求摘要。同时适用于一般的论文阅读和翻译请求,即使不包含“Nature”一词,例如阅读/翻译学术论文、文献阅读、理解论文,以及中文表述如读论文、精读论文、论文翻译、文献翻译、文献阅读、学术阅读、帮我读这篇文章、翻译这篇paper。

version
2.0.0

全文论文Markdown阅读器 — 路由器

此技能分为两层:

  • 静态层位于 static/,包含版本化、可重用的内容片段(核心原则、阅读工作流、输出契约以及每种源格式的提取指南)。
  • 动态层(本文件加上 manifest.yaml)检测请求的源格式,并仅加载当前任务所需的片段。

不要尝试从内存或此路由器应用阅读逻辑。始终按如下所述从磁盘加载片段。

路由协议

每次调用技能时,请遵循以下五个步骤。

1. 加载清单和核心层

读取 manifest.yaml。它声明了 source_format 轴、允许的值以及每个值映射到的文件路径。

同时读取 always_load 下列出的每个文件。这些文件包含适用于每个阅读任务的核心原则、阅读工作流和输出契约,以及用于构建重复术语表的共享术语账本。

2. 检测源格式

使用清单的 detect: 提示和用户输入确定 source_format 值:

  • pdf-text — 可选文本的PDF。默认值。
  • scanned-pdf — 仅图像或需要OCR的PDF。
  • html — 出版商或预印本HTML页面。
  • doi-arxiv — 需要先解析的裸DOI或arXiv链接。
  • pasted-text — 粘贴的文本或笔记,无法恢复原始布局。

在处理前用一行简短说明向用户声明检测到的值,以便用户轻松纠正。一个源可能映射到多个值(例如,解析为PDF的DOI);先加载解析片段,再加载解析后工件的片段。

3. 加载匹配的片段

读取检测到的 source_format 映射的文件。不要读取 static/ 中的每个片段。仅加载步骤2选择的片段。

4. 使用加载的材料构建阅读器

按以下优先级顺序应用加载的片段:

  1. 核心原则(core/principles.md)— 默认双语阅读器,按意义翻译,绝不降级为摘要,版权注意事项。
  2. 源格式片段 — 如何为此输入提取文本、图表。
  3. 阅读工作流(core/workflow.md)— 六步源映射优先流程。
  4. 输出契约(core/output-contract.md)— 必需文件及响应前验证清单。

在翻译过程中构建术语账本(../nature-shared/core/terminology-ledger.md);它将成为 paper.md 的重复术语表和 source_map.json 的词汇表。

如果约束阻止完整处理,仍创建草稿阅读器,并在 translation_notes.md 中标记缺失的页面、图表或低置信度裁剪。不要切换到摘要模式。

5. 仅在需要时引用参考文件

references/ 下的文件是深度参考,非默认。根据清单中 references.on_demand 表按需打开:

  • 详细的图表裁剪和放置 → references/figure-extraction.md
  • paper.md / source_map.json 的精确字段模式 → references/output-spec.md
  • 使用源引用回答后续问题 → references/grounding-rules.md

为何这样拆分

  • 静态层是版本化且可审查的。添加新源格式只需一个新片段加一行清单。
  • 动态层使每次调用成本低廉:只有与当前输入相关的片段进入上下文。
  • 路由器本身故意简短。添加范围时更新片段,而非此文件。
  • 此结构镜像 nature-writingnature-polishing,因此共享内容位于 nature-shared/