nature-reader

nature-reader

熱門

從 PDF、DOI、arXiv、出版商 HTML 或貼上的文字,建立期刊或會議論文的完整中英對照、圖表感知、來源可追溯的 Markdown 閱讀器。當使用者要求翻譯或閱讀論文、製作中英文對照/原文對照/全文翻譯解讀、將圖表提取到正確位置、保持圖表靠近相關文字,或為每個區塊保留確切來源錨點時使用。此技能不得退化為僅摘要輸出,除非使用者明確要求摘要。也觸發於一般論文閱讀與翻譯請求,即使不包含「Nature」一詞,例如閱讀/翻譯學術論文、文獻閱讀、理解論文,以及中文表述如讀論文、精讀論文、論文翻譯、文獻翻譯、文獻閱讀、學術閱讀、幫我讀這篇文章、翻譯這篇 paper。

3萬星標
1786分支
更新於 2026/7/22
SKILL.md
readonlyread-only
name
nature-reader
description

Build full-paper Chinese-English side-by-side, figure/table-aware, source-grounded Markdown readers for journal or conference papers from PDF, DOI, arXiv, publisher HTML, or pasted text. Use whenever the user asks to translate or read a paper, make 中英文对照/原文对照/全文翻译解读, extract figures or tables into the right positions, preserve figure/table placement near relevant prose, or keep exact source anchors for every block. This skill must not degrade into a summary-only output unless the user explicitly asks for a summary. Also trigger on general paper-reading and translation requests even without the word "Nature", such as reading/translating an academic paper, literature reading, understanding a paper, and Chinese phrasings like 读论文、精读论文、论文翻译、文献翻译、文献阅读、学术阅读、帮我读这篇文章、翻译这篇paper.

version
2.0.0

完整論文 Markdown 閱讀器 — 路由器

此技能分為兩層:

  • 靜態層位於 static/ 下,存放版本化、可重複使用的內容片段(核心原則、閱讀工作流程、輸出合約,以及各來源格式的提取指南)。
  • 動態層(此檔案加上 manifest.yaml)偵測請求的來源格式,僅載入當前工作所需的片段。

請勿嘗試從記憶或此路由器套用閱讀邏輯。務必依照以下說明從磁碟載入片段。

路由協定

每次呼叫此技能時,請遵循以下五個步驟。

1. 載入 manifest 與核心層

讀取 manifest.yaml。它宣告了 source_format 軸、允許的值,以及每個值對應的檔案路徑。

同時讀取 always_load 下列出的所有檔案。這些檔案包含適用於每個閱讀工作的核心原則、閱讀工作流程、輸出合約,以及用於建立重複術語表的共用術語分類帳。

2. 偵測來源格式

使用 manifest 的 detect: 提示與使用者輸入,決定 source_format 的值:

  • pdf-text — 可選取文字的 PDF。預設值。
  • scanned-pdf — 僅影像或需 OCR 的 PDF。
  • html — 出版商或預印本的 HTML 頁面。
  • doi-arxiv — 必須先解析的純 DOI 或 arXiv 連結。
  • pasted-text — 貼上的文字或筆記,無可還原的原始版面。

在處理前,用一行簡短文字向使用者說明偵測到的值,以便使用者低成本修正。一個來源可能對應多個值(例如 DOI 解析為 PDF);先載入解析片段,再載入解析後成果的片段。

3. 載入對應的片段

讀取偵測到的 source_format 所對應的檔案。不要讀取 static/ 下的每個片段。僅載入步驟 2 選取的內容。

4. 使用載入的材料建立閱讀器

依以下優先順序套用載入的片段:

  1. 核心原則(core/principles.md)— 預設為雙語閱讀器,為意義而翻譯,絕不退化為摘要,版權注意事項。
  2. 來源格式片段 — 如何為此輸入提取文字、圖表與表格。
  3. 閱讀工作流程(core/workflow.md)— 六步驟的「來源映射優先」流程。
  4. 輸出合約(core/output-contract.md)— 必要檔案與回應前驗證檢查清單。

在翻譯過程中建立術語分類帳(../nature-shared/core/terminology-ledger.md);它將成為 paper.md 的重複術語表與 source_map.json 的詞彙表。

若限制導致無法完整處理,仍應建立草稿閱讀器,並在 translation_notes.md 中標記缺失頁面、圖表或低信心裁切。請勿切換至摘要模式。

5. 僅在需要時參考參考資料

references/ 下的檔案是深度參考資料,非預設值。請依照 manifest 中 references.on_demand 表格按需開啟:

  • 詳細的圖表裁切與放置 → references/figure-extraction.md
  • paper.md / source_map.json 的確切欄位結構 → references/output-spec.md
  • 使用來源引用回答後續問題 → references/grounding-rules.md

為何如此拆分

  • 靜態層是版本化且可審查的。新增來源格式只需一個新片段與一行 manifest。
  • 動態層讓每次呼叫保持輕量:只有與此輸入相關的片段進入上下文。
  • 路由器本身刻意簡短。擴充範圍時請更新片段,而非此檔案。
  • 此結構與 nature-writingnature-polishing 一致,共用內容位於 nature-shared/