baoyu-cover-image

baoyu-cover-image

熱門

結合 11 種色彩調色盤與 7 種渲染風格,提供 5 個客製化維度(類型、調色盤、渲染、文字、氛圍)來生成文章封面圖。支援電影級(2.35:1)、寬螢幕(16:9)及正方形(1:1)等長寬比。當使用者要求「生成封面圖」、「製作文章封面」或「做封面」時使用。

2.2萬星標
2606分支
更新於 2026/6/18
SKILL.md
唯讀
名稱
baoyu-cover-image
描述

結合 11 種色彩調色盤與 7 種渲染風格,提供 5 個客製化維度(類型、調色盤、渲染、文字、氛圍)來生成文章封面圖。支援電影級(2.35:1)、寬螢幕(16:9)及正方形(1:1)等長寬比。當使用者要求「生成封面圖」、「製作文章封面」或「做封面」時使用。

版本
1.117.5

封面圖生成器

透過 5 個維度的客製化選項,為文章生成優雅精美的封面圖。

使用者輸入工具

當此 Skill 需要提示使用者時,請遵循以下工具選擇規則(依優先順序排列):

  1. 優先使用內建的使用者輸入工具:使用當前 Agent 執行階段(runtime)所提供的內建工具,例如 AskUserQuestionrequest_user_inputclarifyask_user 或任何同等工具。
  2. 備用方案(Fallback):若不存在此類工具,請輸出帶有編號的純文字訊息,並請使用者回覆每個問題對應的編號或答案。
  3. 批次處理(Batching):若工具支援單次呼叫提出多個問題,請將所有適用問題整合至單一呼叫中;若僅支援單一問題,則依優先順序一次詢問一個。

下方內文中提及的 AskUserQuestion 均為範例——在其他執行階段中請替換為當地的同等工具。

圖片生成工具

當此 Skill 需要渲染圖片時,請依以下順序確定使用的後端(backend):

  1. 當前請求覆寫——若使用者在當前訊息中指定了特定後端,直接使用該後端。
  2. 已儲存的偏好設定——若 EXTEND.md 中的 preferred_image_backend 指定了目前可用的後端,直接使用該後端。
  3. 自動選擇(當偏好設定為 auto、未設定,或是固定的後端不可用時):
    • Codex (imagegen) — 首先檢查可用 Skill / 工具清單。若列有名為 imagegen 的 Skill,表示您正運作於 Codex 環境中,且必須使用它:透過 Skill 工具傳入 skill: "imagegen" 來呼叫,並傳送已儲存的提示詞檔案內容(以及依 Codex imagegen 自有引數指定的輸出路徑與長寬比)。Codex imagegen 是該執行階段的官方點陣圖後端,優先度高於任何非原生 Skill(例如 baoyu-image-gen),除非使用者已明確指定了不同的 preferred_image_backend
    • 經由 codex exec 的 Codex (codex-imagegen) — 若當前執行階段未提供原生的 imagegen Skill,但 PATH 中有 codex CLI 且已完成 codex login 登入,請優先透過 baoyu-image-gen --provider codex-cli 路由;若 baoyu-image-gen 不可用,則直接呼叫隨附的封裝指令(wrapper)。詳細資訊、參數及執行階段偵測流程請參閱 references/codex-imagegen.md——僅在選擇此分支時載入該檔案。
    • Cursor (GenerateImage) — 若執行階段提供原生的 GenerateImage 工具,表示您正運作於 Cursor 環境中,其優先度同樣高於任何非原生 Skill。請注意兩個硬性限制:(a) 它沒有長寬比參數——請在傳給 description 的提示詞內文中明確註明目標長寬比 / 尺寸;(b) 它不接受輸出目錄——圖片會儲存至工具管理的預設位置,因此生成後需將檔案複製/移動至此 Skill 預期的輸出路徑(例如 outputs/.../NN-xxx.png)。參考圖片則放置於 reference_image_paths
    • 其他執行階段原生工具 — 若執行階段提供不同的原生圖片工具(例如 Hermes 的 image_generate),請以相同方式使用。
    • 否則,若僅安裝了一個非原生後端(例如 baoyu-image-gen),直接使用該後端。
    • 否則(有多個非原生後端且無原生工具),向使用者詢問一次——並與其他初始問題一併批次詢問。
  4. 若皆不可用,告知使用者並詢問後續處理方式。

⛔ 切勿使用 SVG、HTML、Canvas 或其他基於程式碼的渲染來替代點陣圖生成。 Codex imagegen 本身的說明明確指出,應在「輸出目標為點陣圖資產而非專案原生程式碼或向量圖」時使用。若無法透過步驟 3 確定點陣圖後端,請直接降級至步驟 4 詢問使用者——切勿靜默輸出 SVG、撰寫行內 <svg> 標籤,或產生 HTML/CSS 視覺圖形作為替代方案。即使文章/章節看起來像「圖表類」,呼叫此規則的上游 Skill 亦已認定其需要的是點陣圖。

⛔ 切勿透過在已生成的點陣圖上繪製來修復渲染文字。 請勿使用 ImageMagick、Pillow、Canvas、SVG、HTML/CSS、OCR 腳本或任何其他程式化覆蓋方式,去遮蓋、重寫、抹除、加邊框或替換已生成封面圖中的標題/副標題文字。若文字有誤或不清晰,請使用修正後的提示詞重新生成、切換至低文字/無標題變體,或詢問使用者要保留哪一個不完美的備選方案。

設定 preferred_image_backend: ask 可在每次執行時強制觸發步驟 3 的詢問提示,而不論當前可用的後端為何。使用者可透過下方的 ## 變更偏好設定 章節來變更固定的後端。

提示詞檔案硬性要求:在呼叫任何後端之前,必須將每張圖片的完整最終提示詞寫入 prompts/ 目錄下的獨立檔案中(命名格式:NN-{type}-[slug].md)。後端將接收該提示詞檔案(或其內容);此檔案作為可重現性紀錄,能讓您在切換後端時無須重新生成提示詞。

上述具體工具名稱(imagegenGenerateImageimage_generatebaoyu-image-gen)均為範例——在相同規則下請替換為當地的同等工具。

確認原則

預設行為:生成前需先確認

  • 將明確的 Skill 呼叫、檔案路徑、匹配的關鍵字/預設集、EXTEND.md 預設值以及任何已記錄的自動選擇僅視為建議輸入。無一可作為跳過確認的授權。
  • 在使用者確認維度 / 長寬比 / 語言 / 後端選擇之前,切勿啟動步驟 3 或步驟 4。
  • 僅在當前請求明確要求時方可跳過確認,例如:--quick、「直接生成」、「不用確認」、「跳過確認」、「按預設出圖」或同等用語。在 EXTEND.md 中設定 quick_mode: true 視為常態性的明確選擇退出(opt-out)——僅在您希望每次執行皆跳過步驟 2 時才進行設定。
  • 若明確跳過了確認,請在生成前的下一次使用者訊息更新中,說明所採用的維度 / 長寬比 / 語言 / 後端假定設定。

選項

選項 說明
--type <name> hero, conceptual, typography, metaphor, scene, minimal
--palette <name> warm, elegant, cool, dark, earth, vivid, pastel, mono, retro, duotone, macaron
--rendering <name> flat-vector, hand-drawn, painterly, digital, pixel, chalk, screen-print
--style <name> 預設集快捷方式(參閱 Style Presets
--text <level> none, title-only, title-subtitle, text-rich
--mood <level> subtle, balanced, bold
--font <name> clean, handwritten, serif, display
--aspect <ratio> 16:9(預設), 2.35:1, 4:3, 3:2, 1:1, 3:4
--lang <code> 標題語言(en、zh、ja 等)
--no-title --text none 的別名
--quick 跳過確認,使用自動選擇
--ref <files...> 用於風格/構圖指引的參考圖片

5 個維度

維度 數值 預設值
Type hero, conceptual, typography, metaphor, scene, minimal auto
Palette warm, elegant, cool, dark, earth, vivid, pastel, mono, retro, duotone, macaron auto
Rendering flat-vector, hand-drawn, painterly, digital, pixel, chalk, screen-print auto
Text none, title-only, title-subtitle, text-rich title-only
Mood subtle, balanced, bold balanced
Font clean, handwritten, serif, display clean

自動選擇規則:references/auto-selection.md

圖庫

類型(Types):hero, conceptual, typography, metaphor, scene, minimal
→ 詳細資訊:references/types.md

調色盤(Palettes):warm, elegant, cool, dark, earth, vivid, pastel, mono, retro, duotone, macaron
→ 詳細資訊:references/palettes/

渲染(Renderings):flat-vector, hand-drawn, painterly, digital, pixel, chalk, screen-print
→ 詳細資訊:references/renderings/

文字層級(Text Levels):none(純視覺)| title-only(預設)| title-subtitle | text-rich(含標籤)
→ 詳細資訊:references/dimensions/text.md

氛圍層級(Mood Levels):subtle(低對比)| balanced(預設)| bold(高對比)
→ 詳細資訊:references/dimensions/mood.md

字型(Fonts):clean(無襯線)| handwritten(手寫)| serif(襯線)| display(粗體裝飾)
→ 詳細資訊:references/dimensions/font.md

檔案結構

依據 default_output_dir 偏好設定的輸出目錄:

  • same-dir: {article-dir}/
  • imgs-subdir: {article-dir}/imgs/
  • independent(預設): cover-image/{topic-slug}/
<output-dir>/
├── source-{slug}.{ext}    # 來源檔案
├── refs/                  # 參考圖片(若有提供)
│   ├── ref-01-{slug}.{ext}
│   └── ref-01-{slug}.md   # 說明檔案
├── prompts/cover.md       # 生成提示詞
└── cover.png              # 輸出圖片

Slug:2-4 個英文單字,以 kebab-case 格式命名。若衝突:附加 -YYYYMMDD-HHMMSS

工作流程

進度檢查清單

封面圖生成進度:
- [ ] 步驟 0:檢查偏好設定 (EXTEND.md) ⛔ 阻塞性步驟
- [ ] 步驟 1:分析內容 + 儲存參考圖 + 確定輸出目錄
- [ ] 步驟 2:確認選項 (6 個維度) ⚠️ 除非指定 --quick
- [ ] 步驟 3:建立提示詞
- [ ] 步驟 4:生成圖片
- [ ] 步驟 5:完成報告

流程圖

輸入 → [步驟 0:偏好設定] ─┬─ 已找到 → 繼續
                           └─ 未找到 → 首次設定 ⛔ 阻塞性步驟 → 儲存 EXTEND.md → 繼續
        ↓
分析 + 儲存參考圖 → [輸出目錄] → [確認:6 個維度] → 提示詞 → 生成 → 完成
                                       ↓
                           (若指定 --quick 或已全數指定則跳過)

步驟 0:載入偏好設定 ⛔ 阻塞性步驟

依優先順序檢查 EXTEND.md——以第一個找到的為準:

優先順序 路徑 作用域
1 .baoyu-skills/baoyu-cover-image/EXTEND.md 專案
2 ${XDG_CONFIG_HOME:-$HOME/.config}/baoyu-skills/baoyu-cover-image/EXTEND.md XDG
3 $HOME/.baoyu-skills/baoyu-cover-image/EXTEND.md 使用者家目錄
結果 動作
已找到 載入並顯示摘要 → 繼續
未找到 ⛔ 執行首次設定 (references/config/first-time-setup.md) → 儲存 → 繼續

關鍵要點:若未找到,必須在進行任何其他步驟或提問之前完成設定。

步驟 1:分析內容

  1. 儲存參考圖片(若有提供)→ references/workflow/reference-images.md
  2. 儲存來源內容(若為貼上之內容,儲存至 source.md
  3. 分析內容:主題、語調、關鍵字、視覺隱喻
  4. 深度分析參考圖 ⚠️:擷取特定、具體的元素(參閱 reference-images.md
  5. 偵測語言:比對來源內容、使用者輸入及 EXTEND.md 偏好設定
  6. 確定輸出目錄:依據檔案結構規則

⚠️ 參考圖片中的人物:

若參考圖片中包含應出現在封面上的人物

  • 模型支援 --ref(預設):複製圖片至 refs/,生成時透過 --ref 傳入。無需說明檔案——模型可直接辨識臉部。
  • 模型不支援 --ref(即夢、Seedream 3.0):建立包含各角色詳細描述(髮型、眼鏡、膚色、服裝)的 refs/ref-NN-{slug}.md。並將其作為 MUST/REQUIRED(必須)指示嵌入提示詞內文中。

完整決策表請參閱 reference-images.md

步驟 2:確認選項 ⚠️

硬性卡點:依據確認原則,本步驟為強制執行項目——在使用者確認之前,步驟 3–4 不得啟動