wan-2-7

wan-2-7

使用 Wan 2.7(Wan-AI 的旗舰运动模型)在 RunComfy 上生成文本到视频。文档介绍了 Wan 2.7 的优势(多参考条件、通过 `audio_url` 实现音频驱动的唇形同步、更平滑的过渡、提示扩展)、时长/分辨率/宽高比模式,以及何时改用 HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。通过本地 RunComfy CLI 调用 `runcomfy run wan-ai/wan-2-7/text-to-video`。触发词为“wan”、“wan 2.7”、“wan-2-7”、“wan video”或任何明确要求使用此模型生成视频的请求。

20Star
9Fork
更新于 2026/6/14
SKILL.md
readonly只读
name
wan-2-7
description

使用 Wan 2.7(Wan-AI 的旗舰运动模型)在 RunComfy 上生成文本到视频。 文档介绍了 Wan 2.7 的优势(多参考条件、通过 `audio_url` 实现音频驱动的唇形同步、 更平滑的过渡、提示扩展)、时长/分辨率/宽高比模式,以及 何时改用 HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。 通过本地 RunComfy CLI 调用 `runcomfy run wan-ai/wan-2-7/text-to-video`。 触发词为“wan”、“wan 2.7”、“wan-2-7”、“wan video”或任何明确要求使用此模型生成视频的请求。

Wan 2.7 — RunComfy 专业版

runcomfy.com · 文本到视频 · GitHub

Wan-AI 的 Wan 2.7 — 旗舰视频模型,支持多参考条件和音频驱动的唇形同步 — 托管在 RunComfy 模型 API 上。

npx skills add agentspace-so/runcomfy-skills --skill wan-2-7 -g

何时选择此模型(与同类模型对比)

您想要 使用
将视频与您提供的音频轨道进行唇形同步 Wan 2.7 (audio_url)
多参考精细运动控制 Wan 2.7
平滑过渡、精确运动物理 Wan 2.7
当前排名第一的盲选视频模型 HappyHorse 1.0
多模态电影级,支持图像+视频+音频参考及内置语音生成 Seedance 2.0 Pro
对现有素材进行电影级运动编辑 Kling Video O1
超快速迭代 LTX 2

如果用户明确提到“Wan”/“Wan 2.7”/“wan-ai”/“阿里巴巴视频”,则无论其他条件如何,都路由到此模型。

前提条件

  1. RunComfy CLInpm i -g @runcomfy/cli
  2. RunComfy 账户runcomfy login 会打开浏览器设备码流程。
  3. CI / 容器 — 设置 RUNCOMFY_TOKEN=<token> 替代 runcomfy login

端点 + 输入模式

wan-ai/wan-2-7/text-to-video

字段 类型 必填 默认值 说明
prompt string 最多约 5000 字符 / 约 1500 token。
audio_url string WAV/MP3,3–30 秒,≤15MB。驱动唇形同步。 省略则自动生成背景音乐。
aspect_ratio enum 16:9 16:99:161:14:33:4
resolution enum 1080p 720p1080p
duration enum 5 2–15(整数秒)。
negative_prompt string 最多 500 字符。要避免的具体问题。
enable_prompt_expansion bool true 自动重写简短提示。禁用可获得字面控制。
seed int 0..2^31-1。重复使用可生成变体。

如何调用

默认(5 秒 1080p 16:9,提示扩展):

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{"prompt": "<用户提示>"}' \
  --output-dir <绝对路径>

音频驱动的唇形同步(您自己的音频轨道):

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{
    "prompt": "发言人半身近景,暖色主光,固定三脚架,轻微呼吸动作。",
    "audio_url": "https://.../voiceover.mp3",
    "duration": 12,
    "aspect_ratio": "9:16"
  }' \
  --output-dir <绝对路径>

字面控制(无自动扩展):

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{
    "prompt": "<完全按您想要的原文>",
    "enable_prompt_expansion": false,
    "negative_prompt": "无字幕,无闪烁,无扭曲的手"
  }' \
  --output-dir <绝对路径>

提示技巧 — 实际有效的方法

用通俗英语描述镜头和运动。 例如“慢推近”、“固定三脚架,低角度”、“手持跟拍”、“从上方吊臂移动”。将镜头描述放在前面。

每个片段一个主要动作。 不要堆积多个竞争动作。选择一个节拍:“她转身,然后微笑”而不是“她转身并且微笑并且一辆公交车经过并且……”。

使用 negative_prompt 处理具体问题。 好的例子:“无字幕,无水印,无闪烁”。不好的例子(模糊):“无不良照明”。

提示扩展默认开启。 简短提示会被模型自动重写。对于简洁/字面提示(例如品牌严格的广告文案),使用 enable_prompt_expansion: false 禁用。

音频规格很重要。 audio_url 必须为 3–30 秒,≤15MB,WAV/MP3 格式。超出范围的文件会被拒绝。音频长度应与片段时长匹配。

迭代种子。 当您希望同一提示的不同变体输出一致时,重复使用相同种子。更改种子以获得真正的多样性。

反模式:

  • 静态画面描述 → 运动将模糊不清。
  • 模糊的负面提示(如“无不良颜色”)→ 被忽略。
  • 音频超出 3–30 秒 / 15MB / WAV-MP3 规格 → 被拒绝。
  • 提示超过 5000 字符 / 1500 token → 输出质量下降。

适用场景

用例 为什么选择 Wan 2.7
带自定义配音的唇形同步广告 audio_url 接受您的音频轨道
多语言配音变体 相同提示,不同语言的 audio_url
多参考运动控制 最多 5 个参考媒体(图像/视频/语音)
平滑过渡 + 运动物理 强大的物理感知运动先验
通过负面提示获得干净输出 针对性地排除问题

示例提示(已验证能产生强结果)

页面示例(产品展示):

电影级中景,产品置于大理石表面,柔和影棚灯光,缓慢微妙的镜头推进,浅景深,高端商业外观,清晰的 1080p 细节

唇形同步发言人(配合 audio_url):

自信发言人的半身近景,在柔和照明的录音棚中,微微倾向镜头,固定三脚架,浅景深,来自相机左侧的暖色主光。

竖屏平台原生:

9:16 竖屏短视频。一位咖啡师萃取单份浓缩咖啡,蒸汽在晨光中升腾,丰富的油脂慢慢形成。手持近景,浅景深,温暖的咖啡馆氛围。

限制

  • 时长上限 15 秒。 对于更长的叙事,请多次调用拼接。
  • 无原生 4K — 最高 1080p。
  • 宽高比 — 仅限文档中列出的 5 种值。
  • 音频规格 — 仅限 3–30 秒,≤15MB,WAV/MP3 格式。
  • 参考媒体上限 5 个(图像 + 视频 + 语音合计)。
  • 如需内置语音生成(无需单独音频轨道),请使用 Seedance 2.0 Pro — Wan 接受音频而非生成音频。

退出码

代码 含义
0 成功
64 CLI 参数错误
65 输入 JSON 错误 / 模式不匹配
69 上游 5xx 错误
75 可重试:超时 / 429
77 未登录或 token 被拒绝

完整参考:docs.runcomfy.com/cli/troubleshooting

工作原理

该技能使用符合模式的 JSON 主体调用 runcomfy run wan-ai/wan-2-7/text-to-video。CLI 将 POST 请求发送到 https://model-api.runcomfy.net/v1/models/wan-ai/wan-2-7/text-to-video,轮询请求,获取结果,并将任何 .runcomfy.net/.runcomfy.com URL 下载到 --output-dirCtrl-C 会在退出前取消远程请求。

安全与隐私

  • Token 存储runcomfy login 将 API token 写入 ~/.config/runcomfy/token.json,权限为 0600(仅所有者可读写)。在 CI / 容器中设置 RUNCOMFY_TOKEN 环境变量可绕过文件存储。
  • 输入边界:用户提示通过 --input 作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 主体通过 HTTPS 传输到模型 API。提示内容不存在 shell 注入风险。
  • 第三方内容:您传递的图像/遮罩/视频 URL 由 RunComfy 模型服务器获取,而非您机器上的 CLI。请将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
  • 出站端点:仅 model-api.runcomfy.net(请求提交)和 *.runcomfy.net / *.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。
  • 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。