happyhorse-1-0

happyhorse-1-0

使用 RunComfy 上的 HappyHorse 1.0 生成文本到视频。介绍 HappyHorse 1.0 的优势(在 Artificial Analysis Video Arena 排名第一,原生 1080p 并支持同步音频、多镜头角色一致性、6 种语言提示支持)、时长/宽高比/分辨率方案,以及何时改用 Wan 2.7 / Seedance 2 / LTX 2。通过本地 RunComfy CLI 调用 `runcomfy run happyhorse/happyhorse-1-0/text-to-video`。触发词为 "happyhorse"、"happy horse"、"happyhorse 1.0"、"happyhorse video" 或任何明确要求使用此模型生成视频的请求。

2Star
1Fork
更新于 2026/6/18
SKILL.md
readonly只读
name
happyhorse-1-0
description

使用 RunComfy 上的 HappyHorse 1.0 生成文本到视频。介绍 HappyHorse 1.0 的优势(在 Artificial Analysis Video Arena 排名第一,原生 1080p 并支持同步音频、多镜头角色一致性、6 种语言提示支持),时长 / 宽高比 / 分辨率 方案,以及何时改用 Wan 2.7 / Seedance 2 / LTX 2。 通过本地 RunComfy CLI 调用 `runcomfy run happyhorse/happyhorse-1-0/text-to-video`。 触发词为 "happyhorse"、"happy horse"、"happyhorse 1.0"、"happyhorse video" 或任何明确要求使用此模型生成视频的请求。

HappyHorse 1.0 — RunComfy 专业版

runcomfy.com · 文本到视频 · GitHub

HappyHorse 1.0 — 目前在 Artificial Analysis Video Arena 排名第一(Elo 1332 t2v / 1392 i2v)— 托管在 RunComfy 模型 API 上。原生 1080p 视频,支持同步音频(对话、环境音、拟音)和多镜头角色一致性。

npx skills add agentspace-so/runcomfy-skills --skill happyhorse-1-0 -g

何时选择此模型(与同类模型对比)

需求 使用
多镜头故事,角色/服装一致 HappyHorse 1.0
同一生成过程中包含原生音频 HappyHorse 1.0
当前排名第一的盲评视频模型 HappyHorse 1.0
精细唇形同步对话 + 参考视频 Seedance 2.0 Pro
精细运动控制 + 多参考条件 Wan 2.7
超快迭代(每帧亚秒级) LTX 2
对现有素材进行电影级运动编辑 Kling Video O1

如果用户明确提到 "HappyHorse" / "happy horse video",则直接路由到此模型。

前提条件

  1. RunComfy CLInpm i -g @runcomfy/cli
  2. RunComfy 账户runcomfy login 会打开浏览器设备码流程。
  3. CI / 容器 — 设置 RUNCOMFY_TOKEN=<token> 替代 runcomfy login

端点 + 输入模式

happyhorse/happyhorse-1-0/text-to-video

字段 类型 必填 默认值 说明
prompt string 最多 2500 字符。支持 6 种语言(中文/英文/日文/韩文/德文/法文)。
aspect_ratio enum 16:9 仅支持 16:99:161:14:33:4
resolution enum 1080P 720P1080P
duration int 5 3–15 秒。
seed int 0 0..2^31-1。重复使用可进行变体比较。
watermark bool true 提供商水印。

如何调用

默认(16:9 1080p 5秒):

runcomfy run happyhorse/happyhorse-1-0/text-to-video \
  --input '{"prompt": "<用户提示>"}' \
  --output-dir <绝对路径>

竖屏短视频(9:16,8秒,无水印):

runcomfy run happyhorse/happyhorse-1-0/text-to-video \
  --input '{
    "prompt": "<用户提示>",
    "aspect_ratio": "9:16",
    "duration": 8,
    "watermark": false
  }' \
  --output-dir <绝对路径>

更便宜的测试(720p):

runcomfy run happyhorse/happyhorse-1-0/text-to-video \
  --input '{"prompt": "<用户提示>", "resolution": "720P", "duration": 3}' \
  --output-dir <绝对路径>

CLI 提交请求,每 2 秒轮询一次直到完成,然后从结果中下载所有 *.runcomfy.net / *.runcomfy.com URL 到 --output-dir。标准输出为结果 JSON。标准错误为进度信息。

提示技巧 — 实际有效的方法

描述随时间变化的运动,而非静态场景。 "一个女人从窗边转身,走两步到桌前,拿起杯子,举到嘴边,喝了一口" 优于 "一个喝咖啡的女人"。

用简单英语描述镜头和拍摄方式。 将镜头描述放在前面:"Wide shot. ..." / "Tracking shot. ..." / "Locked tripod, low angle. ..." 可作为实际指令。指定镜头感觉:"35mm anamorphic""shallow DOF""crushed shadows"

迭代时每个片段只包含一个视觉节拍。 不要堆砌 "她走路 AND 狗跑 AND 汽车经过"。选择一个节拍,使其清晰,然后通过多镜头提示进行叠加。

多镜头一致性 — 描述两个节拍时,在每个节拍中重复锚点:"Shot 1: tall woman in red wool coat, blue scarf, in a rainy alley. Shot 2: same woman in red coat / blue scarf, now ducking under an awning." HappyHorse 会保持外观,但需要锚点。

音频方向 — 说明你想听到的内容:"distant temple bells, footsteps on wet pavement, no dialogue""warm friendly tone, English"

反模式:

  • 静态画面描述(无时间动词)→ 运动模糊。
  • 冲突的风格指令 → 相互抵消。
  • 超过 2500 字符的提示 → 质量下降。
  • 超出 5 种支持的宽高比 → 返回 422。

适用场景

用例 为什么选择 HappyHorse 1.0
多镜头品牌故事,角色一致 原生跨镜头身份保持
需要视频内配音和环境音的讲解视频 同一生成过程中的同步音频
多语言短视频广告 6 种提示语言,脚本质量不下降
电影级 1080p 交付 原生 1080p 输出,广播级质量
通用视频质量的盲评领先者 Artificial Analysis Video Arena 排名第一

示例提示(已验证可产生强效果)

来自模型页面(电影级场景):

Wide shot. A lone astronaut in dusty orange suit with blue-gray harness
skis across lunar plain, leaving parallel tracks in gray regolith.
Mid-stride, poles planted, pushing in 1/6th gravity with subtle upward
drift. Fine dust haze along ski tracks. Crescent Earth above lunar
horizon, blue-white glow against black sky. Raw sunlight, crushed
shadows, no fill. 8K photorealistic.

多镜头一致性:

Shot 1: Medium close-up. A woman in a navy trench coat enters a
rain-slick neon-lit Tokyo alley, looks left, holds up an umbrella.
Shot 2: Same woman in same navy trench, now under the awning of a
ramen shop, shaking water off the umbrella. Warm interior glow, soft
chatter, gentle rain on metal roof in the audio.

竖屏平台原生:

9:16 vertical short. A barista in a black apron pulls a single
espresso shot, steam rising into the morning sun, rich crema slowly
forming. Close-up handheld, shallow DOF, warm cafe ambience and the
hiss of the steam wand.

限制

  • 时长上限 15 秒 — 对于更长的叙事,拆分为多镜头提示并拼接。
  • 宽高比 — 仅支持 5 种记录值;超宽电影级会被裁剪或拒绝。
  • 音频仅限生成过程中 — 无法传入外部音频驱动唇形同步。如需音频驱动的唇形同步,请使用 Wan 2.7(接受 audio_url)或 Seedance 2.0 Pro。
  • 此模板不支持免费图像到视频 — HappyHorse 通过单独管道支持 i2v;此 t2v 端点仅限文本。

退出码

runcomfy CLI 使用 sysexits 风格码:

含义
0 成功
64 CLI 参数错误
65 输入 JSON 错误 / 模式不匹配(例如 duration: 30 会返回 422)
69 上游 5xx 错误
75 可重试:超时 / 429
77 未登录或令牌被拒绝

完整参考:docs.runcomfy.com/cli/troubleshooting

工作原理

  1. 技能调用 runcomfy run happyhorse/happyhorse-1-0/text-to-video,附带符合模式的 JSON 体。
  2. CLI 使用用户的 bearer 令牌向 https://model-api.runcomfy.net/v1/models/happyhorse/happyhorse-1-0/text-to-video 发送 POST 请求。
  3. 模型 API 返回 request_id;CLI 每 2 秒轮询 GET .../requests/<id>/status
  4. 状态变为终端状态后,CLI 获取 GET .../requests/<id>/result 并下载所有主机名以 .runcomfy.net.runcomfy.com 结尾的 URL 到 --output-dir。其他 URL 仅列出但不下载。
  5. 轮询时按 Ctrl-C 会发送 POST .../requests/<id>/cancel,这样你不会为已停止的 GPU 付费。

此技能不是

不是自托管视频运行器。不是能力授权 — 依赖于有效的 RunComfy 账户。

安全与隐私

  • 令牌存储runcomfy login 将 API 令牌写入 ~/.config/runcomfy/token.json,权限为 0600(仅所有者读写)。在 CI / 容器中设置 RUNCOMFY_TOKEN 环境变量可完全绕过文件。
  • 输入边界:用户提示通过 --input 作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 体通过 HTTPS 传输到模型 API。提示内容无 shell 注入风险。
  • 第三方内容:你传入的图像/蒙版/视频 URL 由 RunComfy 模型服务器获取,而非你机器上的 CLI。将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
  • 出站端点:仅 model-api.runcomfy.net(请求提交)和 *.runcomfy.net / *.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。
  • 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。