
captions-overlay
熱門嵌入字幕工作流程的疊加原則——字幕模型(drop / rail / embed)以及字幕是疊加在影片上的 OVERLAY,絕非預留底部區域而將內容上移。在為談話頭或發布影片添加字幕時載入,在決定某個短語應被刪除、跟隨逐字軌道或晉升為稀缺的嵌入高潮時載入,在佈局將包含字幕的構圖時載入(請勿預留 keep-out 區域),或在字幕下將構圖居中於真實畫面中心時載入。引用 embedded-captions 的 rail+embed 模型以及 product-launch-video 場景代理的約束 #13(字幕疊加,keep-out 區域已廢棄)。應用於 embedded-captions 之上。
Overlay doctrine for the embedded-captions workflow — the caption MODEL (drop / rail / embed) and the rule that captions are an OVERLAY composited on top of the film, never a reserved bottom band you shift content up to avoid. Load when adding captions/subtitles to a talking-head or launch video, when deciding whether a phrase should be dropped, ride the verbatim rail, or be promoted to a scarce embedded climax, when laying out a composition that will carry captions (do NOT reserve a keep-out band), or when centering a composition on the true frame center under captions. Quotes the rail+embed model from embedded-captions and constraint #13 (captions overlay, keep-out band retired) from the product-launch-video scene agent. Applies ON TOP of embedded-captions.
字幕疊加原則
疊加原則——補充上游的
embedded-captions技能。應用於其之上;請勿預期它已整合進上游技能。
這裡結合了兩個概念。首先,字幕模型——每個口語短語是 drop、rail 或 embed,而 embed 是稀缺的、應得的巔峰,並非預設。其次,疊加法則——字幕行作為疊加層合成在影片之上;它不是預留區域,因此你絕不應上移內容或留下死區來「騰出空間」。兩者相輔相成:因為字幕作為疊加層呈現(逐字軌道在前,偶爾的嵌入在主題之後),構圖保持完整畫面,並以真實垂直中心為準居中。
字幕模型——drop / rail / embed
每個口語短語是以下三種之一(逐字引用自 embedded-captions):
| 內容 | 顯示方式 | |
|---|---|---|
| drop | 填充詞——嗯/呃、結巴、自我修正 | 不顯示 |
| rail | 預設——一般口語內容(逐字) | 乾淨的下三分之一字幕,在前方,可讀。一個重點詞可以獲得內聯的 emphasis 高亮(強調色/活動詞彈出)——它仍留在軌道上。 |
| embed | 晉升的巔峰——標題節拍 | 一個大字合成在主題後方(遮罩遮擋),設計進場+出場 |
軌道承載大部分文字;embed 是稀缺的、應得的巔峰——每個節拍 ≤1 個,永不兩個相鄰或同時可見,間隔 ≥ 一個節拍。短片段→通常一個 embed;長解說→每個段落約一個。將每個詞都嵌入是常見錯誤。
這是標準模式形狀(rail = 逐字下三分之一;embed = 合成在主題後方的高潮)。電影模式捨棄 rail,使所有內容都成為 embed 風格——僅在純電影需求時使用,絕不用於解說/旁白等需要文字可讀的情況。
軌道優先,嵌入稀缺(承重規則)
引用自 embedded-captions 的不可協商條款:
- 談話頭/解說影片:軌道優先。 不要嵌入整個逐字稿——大部分文字是軌道;僅嵌入巔峰。將所有內容嵌入是預設錯誤。
- 嵌入稀缺且間隔。 每個句子/節拍 ≤1 個嵌入,永不兩個相鄰或同時可見,間隔 ≥ 一個節拍,最多一個
apex。高潮 = 每個節拍的巔峰,不是「整個片段唯一的亮點」。
疊加法則——字幕不是預留區域
在生成的發布構圖中,當啟用字幕時,Finalize 會合成一個小型、最小化的逐字字幕行作為疊加層在整個影片之上(單行文字,底部居中,約佔畫面高度的底部 5-8%)。它是疊加層,不是預留區域(逐字引用自 product-launch-video 場景代理的約束 #13):
- 將構圖居中於真實垂直中心——y = H / 2(橫向 540,直向 960)。不要為了「騰出空間」給字幕而將內容上移;構圖居中於 0.42 × H 並留下死區是錯誤,而非修正。
- 內容可延伸至畫面底部。全出血的主題、軌道和背景皆可。
- 一條軟性禮貌規則: 避免將_關鍵的小型可讀文字_(如網址行、法律行、副標題)恰好放在字幕行所在的底部約 80px 中心區域——疊加層會與之衝突。大型圖像/卡片/環境內容在字幕下方沒問題;字幕皮膚設計為可在內容上閱讀。
- 沒有機器 keep-out 閘門(舊的
captions.mjs keepout檢查已廢棄)。Finalize 快照 QA 以視覺方式判斷字幕在內容上的可讀性。
當字幕停用時: 相同的定位自由度——疊加層根本不存在。
為何這兩個規則構成一個原則
模型指出軌道在前方,而嵌入是罕見的、合成在主題後方的詞——兩者都是添加到未修改素材上的圖層。疊加法則指出字幕行是合成在整個影片之上的圖層,不是從佈局中切割出的區域。因此在字幕處理流程和發布影片流程中,字幕都是你添加的疊加層,而非你預留的區域:
- 保持完整畫面;以真實中心為準居中;讓內容延伸到邊緣。
- 讓軌道(或小型疊加字幕行)承載逐字文字。
- 僅在真正的巔峰處將詞晉升為嵌入——稀缺、間隔、永不兩個同時出現。
- 不預留任何東西;以視覺而非 keep-out 閘門判斷字幕在內容上的可讀性。





