captions-overlay

captions-overlay

热门

嵌入式字幕工作流的叠加层原则——字幕模型(丢弃/轨道/嵌入)以及字幕是叠加在影片之上的叠加层,绝不是需要上移内容来预留的底部保留带的规则。在向人物访谈或发布视频添加字幕时,在决定某个短语应被丢弃、保留原样轨道或提升为稀缺的嵌入式高潮时,在布局将包含字幕的构图时(不要预留保留带),或在字幕下将构图居中于真实帧中心时加载。引用自 embedded-captions 的轨道+嵌入模型以及 product-launch-video 场景代理的约束 #13(字幕叠加层,保留带已弃用)。在 embedded-captions 之上应用。

3.6万Star
3412Fork
更新于 2026/7/19
SKILL.md
readonly只读
name
captions-overlay
description

嵌入式字幕工作流的叠加层原则——字幕模型(丢弃/轨道/嵌入)以及字幕是叠加在影片之上的叠加层,绝不是需要上移内容来预留的底部保留带的规则。在向人物访谈或发布视频添加字幕时,在决定某个短语应被丢弃、保留原样轨道或提升为稀缺的嵌入式高潮时,在布局将包含字幕的构图时(不要预留保留带),或在字幕下将构图居中于真实帧中心时加载。引用自 embedded-captions 的轨道+嵌入模型以及 product-launch-video 场景代理的约束 #13(字幕叠加层,保留带已弃用)。在 embedded-captions 之上应用。

字幕叠加层原则

叠加层原则——补充上游的 embedded-captions 技能。在其之上应用;不要期望它被合并到上游技能中。

这里结合了两个概念。首先,字幕模型——每个口语短语要么是 drop(丢弃)、rail(轨道)或 embed(嵌入),而嵌入是稀缺的、应得的峰值,而非默认值。其次,叠加层法则——字幕行作为叠加层合成在影片之上;它不是保留区域,因此你永远不需要上移内容或留下死区来“腾出空间”。两者相互强化:因为字幕作为叠加层(原样轨道在前,偶尔的嵌入在主体之后),构图保持完整画幅,并以真实垂直中心居中。

字幕模型——丢弃/轨道/嵌入

每个口语短语都是以下三种之一(直接引自 embedded-captions):

什么 如何显示
丢弃 填充词——嗯/呃、口吃、自我纠正 不显示
轨道 默认——普通口语内容(原样) 清晰的下三分之一字幕,在前景,可读。一个重音词可以内联获得 emphasis 高亮(强调色/活动词弹出)——它仍留在轨道上。
嵌入 提升的峰值——标题节拍 一个大的单词合成在主体之后(遮罩遮挡),设计好的入场和退场

轨道承载大部分文本;嵌入是稀缺的、应得的峰值——每个节拍最多一个,从不两个相邻/同时可见,间隔至少一个节拍。短片段→通常一个嵌入;长解说→大约每节一个。嵌入每个词是常见错误。

这是标准模式形状(轨道=原样下三分之一;嵌入=合成在主体后的高潮)。电影模式丢弃轨道,使所有内容变为嵌入风格——仅用于纯电影需求,绝不要用于需要文字可读的解说/画外音。

轨道优先,嵌入稀缺(承重规则)

引自 embedded-captions 的不可协商项:

  • 人物访谈/解说优先使用轨道。 不要嵌入整个转录——大部分文本是轨道;仅嵌入峰值。嵌入所有内容是默认错误。
  • 嵌入稀缺且间隔。 每个句子/节拍最多一个嵌入,从不两个相邻或同时可见,间隔至少一个节拍,最多一个 apex。高潮=每个节拍的峰值,不是“整个片段的单一回报”。

叠加层法则——字幕不是保留带

在生成的发布构图中,当启用字幕时,finalize 合成一个小的、最小化的逐词字幕行作为叠加层在整部影片之上(单行文本,底部居中,大约画布高度的底部 5-8%)。它是叠加层,不是保留区域(直接引自 product-launch-video 场景代理的约束 #13):

  • 将构图居中于真实垂直中心——y = H / 2(横屏 540,竖屏 960)。不要上移内容来“腾出空间”给字幕;构图居中于 0.42 × H 并留下底部死区是错误,而非修复。
  • 内容可以延伸到画布底部。全出血主体、轨道和背景都欢迎。
  • 一条软性礼貌规则: 避免将_关键的小型可读文本_(URL 行、法律行、副标题)恰好放在字幕行所在的底部约 80px 中心区域——叠加层会与其冲突。字幕下的大图像/卡片/环境内容没问题;字幕皮肤设计为在内容上可读。
  • 没有机器保留门(旧的 captions.mjs keepout 检查已弃用)。Finalize 快照 QA 通过视觉判断字幕在内容上的可读性。

当字幕禁用时: 相同的定位自由——叠加层根本不存在。

为什么这两个规则是一个原则

模型说轨道在前景,嵌入是合成在主体后的稀有词——两者都是添加到未修改素材上的图层。叠加层法则说字幕行是合成在整部影片之上的图层,不是从布局中切割出的带。因此在字幕处理流程和发布视频流程中,字幕是你添加的叠加层,而不是你预留的区域:

  • 保持完整画幅;以真实中心居中;让内容延伸到边缘。
  • 让轨道(或小的叠加层字幕行)承载原样文字。
  • 仅在真正的峰值处将词提升为嵌入——稀缺、间隔、从不两个同时出现。
  • 不预留任何东西;通过视觉判断字幕在内容上的可读性,而不是通过保留门。