
happyhorse-1-0
使用 RunComfy 上的 HappyHorse 1.0 生成文本到视频。介绍 HappyHorse 1.0 的优势(在 Artificial Analysis Video Arena 排名第一,原生 1080p 并支持同步音频、多镜头角色一致性、6 种语言提示支持)、时长/宽高比/分辨率方案,以及何时改用 Wan 2.7 / Seedance 2 / LTX 2。通过本地 RunComfy CLI 调用 `runcomfy run happyhorse/happyhorse-1-0/text-to-video`。触发词为 "happyhorse"、"happy horse"、"happyhorse 1.0"、"happyhorse video" 或任何明确要求使用此模型生成视频的请求。
使用 RunComfy 上的 HappyHorse 1.0 生成文本到视频。介绍 HappyHorse 1.0 的优势(在 Artificial Analysis Video Arena 排名第一,原生 1080p 并支持同步音频、多镜头角色一致性、6 种语言提示支持),时长 / 宽高比 / 分辨率 方案,以及何时改用 Wan 2.7 / Seedance 2 / LTX 2。 通过本地 RunComfy CLI 调用 `runcomfy run happyhorse/happyhorse-1-0/text-to-video`。 触发词为 "happyhorse"、"happy horse"、"happyhorse 1.0"、"happyhorse video" 或任何明确要求使用此模型生成视频的请求。
HappyHorse 1.0 — RunComfy 专业版
runcomfy.com · 文本到视频 · GitHub
HappyHorse 1.0 — 目前在 Artificial Analysis Video Arena 排名第一(Elo 1332 t2v / 1392 i2v)— 托管在 RunComfy 模型 API 上。原生 1080p 视频,支持同步音频(对话、环境音、拟音)和多镜头角色一致性。
npx skills add agentspace-so/runcomfy-skills --skill happyhorse-1-0 -g
何时选择此模型(与同类模型对比)
| 需求 | 使用 |
|---|---|
| 多镜头故事,角色/服装一致 | HappyHorse 1.0 |
| 同一生成过程中包含原生音频 | HappyHorse 1.0 |
| 当前排名第一的盲评视频模型 | HappyHorse 1.0 |
| 精细唇形同步对话 + 参考视频 | Seedance 2.0 Pro |
| 精细运动控制 + 多参考条件 | Wan 2.7 |
| 超快迭代(每帧亚秒级) | LTX 2 |
| 对现有素材进行电影级运动编辑 | Kling Video O1 |
如果用户明确提到 "HappyHorse" / "happy horse video",则直接路由到此模型。
前提条件
- RunComfy CLI —
npm i -g @runcomfy/cli - RunComfy 账户 —
runcomfy login会打开浏览器设备码流程。 - CI / 容器 — 设置
RUNCOMFY_TOKEN=<token>替代runcomfy login。
端点 + 输入模式
happyhorse/happyhorse-1-0/text-to-video
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
prompt |
string | 是 | — | 最多 2500 字符。支持 6 种语言(中文/英文/日文/韩文/德文/法文)。 |
aspect_ratio |
enum | 否 | 16:9 |
仅支持 16:9、9:16、1:1、4:3、3:4。 |
resolution |
enum | 否 | 1080P |
720P 或 1080P。 |
duration |
int | 否 | 5 | 3–15 秒。 |
seed |
int | 否 | 0 | 0..2^31-1。重复使用可进行变体比较。 |
watermark |
bool | 否 | true | 提供商水印。 |
如何调用
默认(16:9 1080p 5秒):
runcomfy run happyhorse/happyhorse-1-0/text-to-video \
--input '{"prompt": "<用户提示>"}' \
--output-dir <绝对路径>
竖屏短视频(9:16,8秒,无水印):
runcomfy run happyhorse/happyhorse-1-0/text-to-video \
--input '{
"prompt": "<用户提示>",
"aspect_ratio": "9:16",
"duration": 8,
"watermark": false
}' \
--output-dir <绝对路径>
更便宜的测试(720p):
runcomfy run happyhorse/happyhorse-1-0/text-to-video \
--input '{"prompt": "<用户提示>", "resolution": "720P", "duration": 3}' \
--output-dir <绝对路径>
CLI 提交请求,每 2 秒轮询一次直到完成,然后从结果中下载所有 *.runcomfy.net / *.runcomfy.com URL 到 --output-dir。标准输出为结果 JSON。标准错误为进度信息。
提示技巧 — 实际有效的方法
描述随时间变化的运动,而非静态场景。 "一个女人从窗边转身,走两步到桌前,拿起杯子,举到嘴边,喝了一口" 优于 "一个喝咖啡的女人"。
用简单英语描述镜头和拍摄方式。 将镜头描述放在前面:"Wide shot. ..." / "Tracking shot. ..." / "Locked tripod, low angle. ..." 可作为实际指令。指定镜头感觉:"35mm anamorphic"、"shallow DOF"、"crushed shadows"。
迭代时每个片段只包含一个视觉节拍。 不要堆砌 "她走路 AND 狗跑 AND 汽车经过"。选择一个节拍,使其清晰,然后通过多镜头提示进行叠加。
多镜头一致性 — 描述两个节拍时,在每个节拍中重复锚点:"Shot 1: tall woman in red wool coat, blue scarf, in a rainy alley. Shot 2: same woman in red coat / blue scarf, now ducking under an awning." HappyHorse 会保持外观,但需要锚点。
音频方向 — 说明你想听到的内容:"distant temple bells, footsteps on wet pavement, no dialogue" 或 "warm friendly tone, English"。
反模式:
- 静态画面描述(无时间动词)→ 运动模糊。
- 冲突的风格指令 → 相互抵消。
- 超过 2500 字符的提示 → 质量下降。
- 超出 5 种支持的宽高比 → 返回 422。
适用场景
| 用例 | 为什么选择 HappyHorse 1.0 |
|---|---|
| 多镜头品牌故事,角色一致 | 原生跨镜头身份保持 |
| 需要视频内配音和环境音的讲解视频 | 同一生成过程中的同步音频 |
| 多语言短视频广告 | 6 种提示语言,脚本质量不下降 |
| 电影级 1080p 交付 | 原生 1080p 输出,广播级质量 |
| 通用视频质量的盲评领先者 | Artificial Analysis Video Arena 排名第一 |
示例提示(已验证可产生强效果)
来自模型页面(电影级场景):
Wide shot. A lone astronaut in dusty orange suit with blue-gray harness
skis across lunar plain, leaving parallel tracks in gray regolith.
Mid-stride, poles planted, pushing in 1/6th gravity with subtle upward
drift. Fine dust haze along ski tracks. Crescent Earth above lunar
horizon, blue-white glow against black sky. Raw sunlight, crushed
shadows, no fill. 8K photorealistic.
多镜头一致性:
Shot 1: Medium close-up. A woman in a navy trench coat enters a
rain-slick neon-lit Tokyo alley, looks left, holds up an umbrella.
Shot 2: Same woman in same navy trench, now under the awning of a
ramen shop, shaking water off the umbrella. Warm interior glow, soft
chatter, gentle rain on metal roof in the audio.
竖屏平台原生:
9:16 vertical short. A barista in a black apron pulls a single
espresso shot, steam rising into the morning sun, rich crema slowly
forming. Close-up handheld, shallow DOF, warm cafe ambience and the
hiss of the steam wand.
限制
- 时长上限 15 秒 — 对于更长的叙事,拆分为多镜头提示并拼接。
- 宽高比 — 仅支持 5 种记录值;超宽电影级会被裁剪或拒绝。
- 音频仅限生成过程中 — 无法传入外部音频驱动唇形同步。如需音频驱动的唇形同步,请使用 Wan 2.7(接受
audio_url)或 Seedance 2.0 Pro。 - 此模板不支持免费图像到视频 — HappyHorse 通过单独管道支持 i2v;此 t2v 端点仅限文本。
退出码
runcomfy CLI 使用 sysexits 风格码:
| 码 | 含义 |
|---|---|
| 0 | 成功 |
| 64 | CLI 参数错误 |
| 65 | 输入 JSON 错误 / 模式不匹配(例如 duration: 30 会返回 422) |
| 69 | 上游 5xx 错误 |
| 75 | 可重试:超时 / 429 |
| 77 | 未登录或令牌被拒绝 |
完整参考:docs.runcomfy.com/cli/troubleshooting。
工作原理
- 技能调用
runcomfy run happyhorse/happyhorse-1-0/text-to-video,附带符合模式的 JSON 体。 - CLI 使用用户的 bearer 令牌向
https://model-api.runcomfy.net/v1/models/happyhorse/happyhorse-1-0/text-to-video发送 POST 请求。 - 模型 API 返回
request_id;CLI 每 2 秒轮询GET .../requests/<id>/status。 - 状态变为终端状态后,CLI 获取
GET .../requests/<id>/result并下载所有主机名以.runcomfy.net或.runcomfy.com结尾的 URL 到--output-dir。其他 URL 仅列出但不下载。 - 轮询时按
Ctrl-C会发送POST .../requests/<id>/cancel,这样你不会为已停止的 GPU 付费。
此技能不是
不是自托管视频运行器。不是能力授权 — 依赖于有效的 RunComfy 账户。
安全与隐私
- 令牌存储:
runcomfy login将 API 令牌写入~/.config/runcomfy/token.json,权限为 0600(仅所有者读写)。在 CI / 容器中设置RUNCOMFY_TOKEN环境变量可完全绕过文件。 - 输入边界:用户提示通过
--input作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 体通过 HTTPS 传输到模型 API。提示内容无 shell 注入风险。 - 第三方内容:你传入的图像/蒙版/视频 URL 由 RunComfy 模型服务器获取,而非你机器上的 CLI。将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
- 出站端点:仅
model-api.runcomfy.net(请求提交)和*.runcomfy.net/*.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。 - 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。





