captions-overlay

captions-overlay

熱門

嵌入字幕工作流程的疊加原則——字幕模型(drop / rail / embed)以及字幕是疊加在影片上的 OVERLAY,絕非預留底部區域而將內容上移。在為談話頭或發布影片添加字幕時載入,在決定某個短語應被刪除、跟隨逐字軌道或晉升為稀缺的嵌入高潮時載入,在佈局將包含字幕的構圖時載入(請勿預留 keep-out 區域),或在字幕下將構圖居中於真實畫面中心時載入。引用 embedded-captions 的 rail+embed 模型以及 product-launch-video 場景代理的約束 #13(字幕疊加,keep-out 區域已廢棄)。應用於 embedded-captions 之上。

3.6萬星標
3412分支
更新於 2026/7/19
SKILL.md
readonlyread-only
name
captions-overlay
description

Overlay doctrine for the embedded-captions workflow — the caption MODEL (drop / rail / embed) and the rule that captions are an OVERLAY composited on top of the film, never a reserved bottom band you shift content up to avoid. Load when adding captions/subtitles to a talking-head or launch video, when deciding whether a phrase should be dropped, ride the verbatim rail, or be promoted to a scarce embedded climax, when laying out a composition that will carry captions (do NOT reserve a keep-out band), or when centering a composition on the true frame center under captions. Quotes the rail+embed model from embedded-captions and constraint #13 (captions overlay, keep-out band retired) from the product-launch-video scene agent. Applies ON TOP of embedded-captions.

字幕疊加原則

疊加原則——補充上游的 embedded-captions 技能。應用於其之上;請勿預期它已整合進上游技能。

這裡結合了兩個概念。首先,字幕模型——每個口語短語是 droprailembed,而 embed 是稀缺的、應得的巔峰,並非預設。其次,疊加法則——字幕行作為疊加層合成在影片之上;它不是預留區域,因此你絕不應上移內容或留下死區來「騰出空間」。兩者相輔相成:因為字幕作為疊加層呈現(逐字軌道在前,偶爾的嵌入在主題之後),構圖保持完整畫面,並以真實垂直中心為準居中。

字幕模型——drop / rail / embed

每個口語短語是以下三種之一(逐字引用自 embedded-captions):

內容 顯示方式
drop 填充詞——嗯/呃、結巴、自我修正 不顯示
rail 預設——一般口語內容(逐字) 乾淨的下三分之一字幕,在前方,可讀。一個重點詞可以獲得內聯的 emphasis 高亮(強調色/活動詞彈出)——它仍留在軌道上。
embed 晉升的巔峰——標題節拍 一個大字合成在主題後方(遮罩遮擋),設計進場+出場

軌道承載大部分文字;embed 是稀缺的、應得的巔峰——每個節拍 ≤1 個,永不兩個相鄰或同時可見,間隔 ≥ 一個節拍。短片段→通常一個 embed;長解說→每個段落約一個。將每個詞都嵌入是常見錯誤。

這是標準模式形狀(rail = 逐字下三分之一;embed = 合成在主題後方的高潮)。電影模式捨棄 rail,使所有內容都成為 embed 風格——僅在純電影需求時使用,絕不用於解說/旁白等需要文字可讀的情況。

軌道優先,嵌入稀缺(承重規則)

引用自 embedded-captions 的不可協商條款:

  • 談話頭/解說影片:軌道優先。 不要嵌入整個逐字稿——大部分文字是軌道;僅嵌入巔峰。將所有內容嵌入是預設錯誤。
  • 嵌入稀缺且間隔。 每個句子/節拍 ≤1 個嵌入,永不兩個相鄰或同時可見,間隔 ≥ 一個節拍,最多一個 apex。高潮 = 每個節拍的巔峰,不是「整個片段唯一的亮點」。

疊加法則——字幕不是預留區域

在生成的發布構圖中,當啟用字幕時,Finalize 會合成一個小型、最小化的逐字字幕行作為疊加層在整個影片之上(單行文字,底部居中,約佔畫面高度的底部 5-8%)。它是疊加層,不是預留區域(逐字引用自 product-launch-video 場景代理的約束 #13):

  • 將構圖居中於真實垂直中心——y = H / 2(橫向 540,直向 960)。不要為了「騰出空間」給字幕而將內容上移;構圖居中於 0.42 × H 並留下死區是錯誤,而非修正。
  • 內容可延伸至畫面底部。全出血的主題、軌道和背景皆可。
  • 一條軟性禮貌規則: 避免將_關鍵的小型可讀文字_(如網址行、法律行、副標題)恰好放在字幕行所在的底部約 80px 中心區域——疊加層會與之衝突。大型圖像/卡片/環境內容在字幕下方沒問題;字幕皮膚設計為可在內容上閱讀。
  • 沒有機器 keep-out 閘門(舊的 captions.mjs keepout 檢查已廢棄)。Finalize 快照 QA 以視覺方式判斷字幕在內容上的可讀性。

當字幕停用時: 相同的定位自由度——疊加層根本不存在。

為何這兩個規則構成一個原則

模型指出軌道在前方,而嵌入是罕見的、合成在主題後方的詞——兩者都是添加到未修改素材上的圖層。疊加法則指出字幕行是合成在整個影片之上的圖層,不是從佈局中切割出的區域。因此在字幕處理流程和發布影片流程中,字幕都是你添加的疊加層,而非你預留的區域:

  • 保持完整畫面;以真實中心為準居中;讓內容延伸到邊緣。
  • 讓軌道(或小型疊加字幕行)承載逐字文字。
  • 僅在真正的巔峰處將詞晉升為嵌入——稀缺、間隔、永不兩個同時出現。
  • 不預留任何東西;以視覺而非 keep-out 閘門判斷字幕在內容上的可讀性。