支援多種畫風與基調的知識漫畫創作工具。可生成具備詳細分鏡排版與批次圖片繪製功能的原創教育漫畫。當使用者要求建立「知識漫畫」、「教育漫畫」、「人物傳記漫畫」、「教學漫畫」或「Logicomix 風格漫畫」時使用。
知識漫畫創作工具 (Knowledge Comic Creator)
創作具備彈性畫風與基調組合的原創知識漫畫。
使用者輸入工具 (User Input Tools)
當此 Skill 需要提示使用者時,請遵循以下工具選擇規則(按優先順序):
- 優先使用內建的使用者輸入工具:由目前 Agent 執行環境提供的工具,例如
AskUserQuestion、request_user_input、clarify、ask_user或任何同等工具。 - 備用方案 (Fallback):若不存在此類工具,請發送帶有編號的純文字訊息,並要求使用者針對每個問題回覆所選的編號/答案。
- 批次處理 (Batching):若工具支援單次呼叫提出多個問題,請將所有適用問題合併為單次呼叫;若僅支援單一問題,請按優先順序一次詢問一個。
下方具體的 AskUserQuestion 參考僅為範例——在其他執行環境中請替換為當地的同等工具。
圖片生成工具 (Image Generation Tools)
當此 Skill 需要繪製圖片時,請按以下順序解析後端:
- 當前請求覆寫 (Current-request override) — 若使用者在當前訊息中指定了特定後端,請直接使用該後端。
- 已儲存偏好 (Saved preference) — 若
EXTEND.md將preferred_image_backend設定為目前可用的後端,請直接使用。 - 自動選擇 (Auto-select)(當偏好為
auto、未設定或綁定的後端不可用時):- Codex (
imagegen) — 首先檢查可用 Skill / 工具清單。若列出名為imagegen的 Skill,表示您正在 Codex 內部執行,必須使用它:透過Skill工具呼叫並傳入skill: "imagegen",傳遞已儲存的提示詞檔案內容(加上 Codeximagegen自有引數所需的輸出路徑與長寬比)。Codeximagegen是該執行環境中的官方點陣圖後端,優先級高於任何非原生 Skill(例如baoyu-image-gen),除非使用者已明確綁定不同的preferred_image_backend。 - 透過
codex exec的 Codex (codex-imagegen) — 若當前執行環境未提供原生的imagegenSkill,但PATH上有codexCLI 且處於已登入(codex login)狀態,請透過baoyu-image-gen --provider codex-cli(優先)路由;若 baoyu-image-gen 不可用,則直接呼叫隨附的包裝器(wrapper)。詳細資訊、參數與執行環境探索程序請參閱 references/codex-imagegen.md — 僅在選中此分支時載入該檔案。 - Cursor (
GenerateImage) — 若執行環境提供原生的GenerateImage工具,表示您正在 Cursor 內部執行,其優先級高於任何非原生 Skill(與 Codeximagegen相同)。兩個硬性限制:(a) 它沒有長寬比參數 — 必須在傳遞給description的提示詞文字中明確說明目標長寬比/尺寸;(b) 它不接受輸出目錄 — 會儲存至工具管理的預設位置,因此生成後請將檔案複製/移動至 Skill 預期的輸出路徑(例如outputs/.../NN-xxx.png)。參考圖片放入reference_image_paths。 - 其他執行環境原生工具 — 若執行環境提供其他原生圖片工具(例如 Hermes 的
image_generate),請以相同方式使用。 - 否則,若僅安裝了一個非原生後端(例如
baoyu-image-gen),請使用該後端。 - 否則(多個非原生後端且無執行環境原生工具),詢問使用者一次 — 與其他初始問題一併批次詢問。
- Codex (
- 若皆不可用,告知使用者並詢問如何繼續。
⛔ 切勿使用 SVG、HTML、Canvas 或其他基於程式碼的繪製方式來替代點陣圖生成。 Codex imagegen 的說明明確指出應用於「當輸出應為點陣圖資產而非專案原生程式碼或向量圖時」。若無法透過步驟 3 判定點陣圖後端,請降級至步驟 4 詢問使用者——切勿暗中輸出 SVG、撰寫內嵌 <svg> 標籤或產生 HTML/CSS 藝術作為替代方案。即使文章/章節看起來像「圖表」也適用此規則:呼叫此規則的下游 Skill 已決定其需要的是點陣圖。
⛔ 切勿在已生成的點陣圖上塗抹修改文字。 請勿使用 ImageMagick、Pillow、Canvas、SVG、HTML/CSS、OCR 腳本或任何其他程式化覆蓋層來覆蓋、重寫、擦除、加邊框或替換已生成的漫畫頁面中的對白、音效、分鏡標籤或任何其他文字。若文字有誤或不清晰,請使用修正後的提示詞重新生成、重新繪製包含較少或不含圖片文字的頁面,或詢問使用者要保留哪一個不完美的候選版本。
將 preferred_image_backend: ask 設定為 ask 會在每次執行時強制觸發步驟 3 的提示,無論是否有可用後端。使用者可透過下方的 ## 變更偏好設定 章節變更綁定的後端。
提示詞檔案硬性要求 (Hard requirement):在呼叫任何後端之前,將每張圖片的完整最終提示詞寫入 prompts/ 底下的獨立檔案中(命名格式:NN-{type}-[slug].md)。後端接收提示詞檔案(或其內容);該檔案是可重複性的紀錄,能讓您在不重新生成提示詞的情況下切換後端。
上述具體工具名稱(imagegen、GenerateImage、image_generate、baoyu-image-gen)僅為範例——請在相同規則下替換為當地的同等工具。
批次生成策略 (Batch Generation Policy)
當目前生成組的每個提示詞檔案都已儲存並確認無誤後,預設採用批次方式生成圖片。
優先順序:
- 若所選後端存在原生的批次 / 多任務介面,優先使用該介面。每個任務必須保留自己的提示詞檔案、輸出路徑、長寬比、工作階段 ID (session ID) 與直接參考圖片。
- 若不存在原生批次介面,但執行環境支援平行呼叫工具,每次最多發送
generation_batch_size張圖片。預設值:4。若目前訊息中有明確的使用者需求(例如--batch-size 4或「平行4張一起生成」),將覆寫 EXTEND.md 的設定。 - 若原生批次和平行工具呼叫皆不可用,則按順序串行生成。
規則:
- 優先遵循工作流程相依性:先生成
characters/characters.png,再生成將其作為參考的頁面。 - 在所有選定的頁面提示詞檔案皆已存在於磁碟之前,切勿開始第一批頁面生成。
- 失敗的項目僅重試一次,無需重新生成已成功的項目。
- 請勿僅為了平行化圖片繪製而使用 Subagent。僅在需要獨立的提示詞疊代或創意探索時才使用 Subagent。
參考圖片 (Reference Images)
使用者可提供參考圖片以引導畫風、調色盤、場景構圖或主題。這與自動生成的角色設定集(步驟 7.1)是分開的——兩者可以共存:使用者參考圖引導整體視覺風格,角色設定集則固定重複出現角色的特徵。
接收方式:透過 --ref <files...> 接收,或當使用者在對話中提供檔案路徑/貼上圖片時接收。
- 檔案路徑 → 複製至漫畫輸出目錄旁的
refs/NN-ref-{slug}.{ext} - 貼上圖片但無路徑 → 詢問使用者路徑(依據上述使用者輸入工具規則),或以口頭方式擷取畫風特徵作為文字備用方案
- 無參考圖 → 跳過此章節
使用模式(按參考圖分類):
| 用途 | 效果 |
|---|---|
direct |
在每一頁(或選定頁面)將檔案作為參考圖片傳遞給後端 |
style |
擷取畫風特徵(線條處理、質感、氛圍)並附加至每一頁的提示詞主體 |
palette |
擷取 Hex 色碼並附加至每一頁的提示詞主體 |
存在參考圖時,紀錄於每一頁提示詞的 frontmatter 中:
references:
- ref_id: 01
filename: 01-ref-scene.png
usage: direct
生成時:
- 確認每個參考檔案皆存在於磁碟上
- 若
usage: direct且所選後端接受多張參考圖片 → 透過後端的參考參數同時傳遞角色設定集(步驟 7.2)與使用者參考圖;依步驟 7.1 的指引先壓縮圖片以避免 Payload 失敗 - 若後端僅接受一張參考圖 → 對於有重複角色的頁面,優先使用角色設定集;改將使用者參考圖特徵嵌入至提示詞主體中
- 對於
style/palette用途 → 將擷取的特徵嵌入至每一頁的提示詞文字中(無論後端功能如何皆適用)
選項 (Options)
視覺維度
| 選項 | 數值 | 說明 |
|---|---|---|
--art |
ligne-claire (預設), manga, realistic, ink-brush, chalk, minimalist | 藝術風格 / 繪製技法 |
--tone |
neutral (預設), warm, dramatic, romantic, energetic, vintage, action | 基調 / 氛圍 |
--layout |
standard (預設), cinematic, dense, splash, mixed, webtoon, four-panel | 分鏡排版 |
--aspect |
3:4 (預設, 直式), 4:3 (橫式), 16:9 (寬螢幕) | 頁面長寬比 |
--lang |
auto (預設), zh, en, ja 等 | 輸出語言 |
--ref <files...> |
檔案路徑 | 套用至每一頁的參考圖片,用於畫風 / 色彩 / 場景引導。參見上方的 參考圖片。 |
--batch-size <n> |
1-8 | 此回合執行的臨時頁面生成批次大小。預設值:來自 EXTEND.md 的 generation_batch_size,否則為 4。 |
部分工作流程選項
| 選項 | 說明 |
|---|---|
--storyboard-only |
僅生成分鏡腳本,跳過提示詞與圖片 |
--prompts-only |
生成分鏡腳本 + 提示詞,跳過圖片 |
--images-only |
僅從現有的提示詞目錄生成圖片 |
--regenerate N |
僅重新生成特定頁面(例如 3 或 2,5,8) |
詳細資訊:references/partial-workflows.md
畫風、基調與預設組合目錄
-
藝術風格 (6 種):
ligne-claire、manga、realistic、ink-brush、chalk、minimalist。完整定義見references/art-styles/<style>.md。 -
基調 (7 種):
neutral、warm、dramatic、romantic、energetic、vintage、action。完整定義見references/tones/<tone>.md。 -
預設組合 (Presets) (5 種),包含超越單純畫風+基調的特殊規則:
預設組合 等同於 亮點/特色 ohmshamanga + neutral 視覺隱喻、無枯燥對話頭像、道具/裝置展示 wuxiaink-brush + action 氣功特效、打鬥視覺、極具氛圍感 shoujomanga + romantic 裝飾性元素、眼部細節、浪漫節奏 concept-storymanga + warm 視覺符號系統、成長弧線、對白與動作平衡 four-panelminimalist + neutral + four-panel layout 起承轉合結構、黑白+點綴色、火柴人/簡筆畫角色 完整規則見
references/presets/<preset>.md— 選定預設組合時請載入該檔案。 -
相容性矩陣與 內容訊號 → 預設組合 對照表位於 references/auto-selection.md。在步驟 2 推薦組合之前請先閱讀。
腳本目錄 (Script Directory)
重要:所有腳本皆位於此 Skill 的 scripts/ 子目錄中。
Agent 執行說明:
- 將此 SKILL.md 檔案的目錄路徑判定為
{baseDir} - 腳本路徑 =
{baseDir}/scripts/<script-name>.ts - 將本文件中所有的
{baseDir}替換為實際路徑 - 解析
${BUN_X}執行階段:若已安裝bun→bun;若可用npx→npx -y bun;否則建議安裝 bun
腳本參考:
| 腳本 | 用途 |
|---|---|
scripts/merge-to-pdf.ts |
將漫畫頁面合併為 PDF |
檔案結構 (File Structure)
輸出目錄:comic/{topic-slug}/
- Slug:取自主題的 2-4 個英文單字 kebab-case(例如
alan-turing-bio) - 命名衝突:附加時間戳記(例如
turing-story-20260118-143052)
內容:
| 檔案 | 說明 |
|---|---|
source-{slug}.{ext} |
原始檔案 |
analysis.md |
內容分析 |
storyboard.md |
包含分鏡拆解的分鏡腳本 |
characters/characters.md |
角色定義 |
<!-- truncated for translation batch; full body continues in source -->






