
wan-2-7
使用 RunComfy 上的 Wan 2.7(Wan-AI 旗舰运动模型)生成文本到视频。文档涵盖 Wan 2.7 的优势(多参考条件、通过 audio_url 实现音频驱动的唇形同步、更平滑的过渡、提示扩展)、时长/分辨率/宽高比模式,以及何时改用 HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。通过本地 RunComfy CLI 调用 runcomfy run wan-ai/wan-2-7/text-to-video。触发词为“wan”、“wan 2.7”、“wan-2-7”、“wan video”或任何明确要求使用此模型生成视频的请求。
使用 RunComfy 上的 Wan 2.7(Wan-AI 旗舰运动模型)生成文本到视频。 文档涵盖 Wan 2.7 的优势(多参考条件、通过 `audio_url` 实现音频驱动的唇形同步、 更平滑的过渡、提示扩展)、时长/分辨率/宽高比模式,以及 何时改用 HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。 通过本地 RunComfy CLI 调用 `runcomfy run wan-ai/wan-2-7/text-to-video`。 触发词为“wan”、“wan 2.7”、“wan-2-7”、“wan video”或任何明确要求使用此模型生成视频的请求。
Wan 2.7 — RunComfy 专业包
runcomfy.com · 文本到视频 · GitHub
Wan-AI 的 Wan 2.7 — 旗舰视频模型,支持多参考条件和音频驱动的唇形同步 — 托管在 RunComfy 模型 API 上。
npx skills add agentspace-so/runcomfy-skills --skill wan-2-7 -g
何时选择此模型(与同类模型对比)
| 您想要 | 使用 |
|---|---|
| 将视频与您提供的音频轨道进行唇形同步 | Wan 2.7 (audio_url) |
| 多参考精细运动控制 | Wan 2.7 |
| 平滑过渡、精确运动物理 | Wan 2.7 |
| 当前盲评排名第一的视频模型 | HappyHorse 1.0 |
| 多模态电影级,支持图像+视频+音频参考及内置语音生成 | Seedance 2.0 Pro |
| 对现有素材进行电影级运动编辑 | Kling Video O1 |
| 超快速迭代 | LTX 2 |
如果用户明确提到“Wan”/“Wan 2.7”/“wan-ai”/“阿里巴巴视频”,则直接路由至此。
前提条件
- RunComfy CLI —
npm i -g @runcomfy/cli - RunComfy 账户 —
runcomfy login会打开浏览器设备码流程。 - CI / 容器 — 设置
RUNCOMFY_TOKEN=<token>替代runcomfy login。
端点 + 输入模式
wan-ai/wan-2-7/text-to-video
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
prompt |
string | 是 | — | 最多约 5000 字符 / 约 1500 token。 |
audio_url |
string | 否 | — | WAV/MP3,3–30 秒,≤15MB。驱动唇形同步。 省略则自动生成背景音乐。 |
aspect_ratio |
enum | 否 | 16:9 |
16:9、9:16、1:1、4:3、3:4。 |
resolution |
enum | 否 | 1080p |
720p 或 1080p。 |
duration |
enum | 否 | 5 |
2–15(整数秒)。 |
negative_prompt |
string | 否 | — | 最多 500 字符。要避免的具体问题。 |
enable_prompt_expansion |
bool | 否 | true | 自动重写简短提示。禁用可获得字面控制。 |
seed |
int | 否 | — | 0..2^31-1。重复使用以生成变体。 |
如何调用
默认(5 秒 1080p 16:9,提示扩展):
runcomfy run wan-ai/wan-2-7/text-to-video \
--input '{"prompt": "<用户提示>"}' \
--output-dir <绝对路径>
音频驱动的唇形同步(您自己的音轨):
runcomfy run wan-ai/wan-2-7/text-to-video \
--input '{
"prompt": "发言人半身近景,暖色主光,固定三脚架,轻微呼吸动作。",
"audio_url": "https://.../voiceover.mp3",
"duration": 12,
"aspect_ratio": "9:16"
}' \
--output-dir <绝对路径>
字面控制(无自动扩展):
runcomfy run wan-ai/wan-2-7/text-to-video \
--input '{
"prompt": "<完全按您想要的原文>",
"enable_prompt_expansion": false,
"negative_prompt": "无字幕,无闪烁,无扭曲的手"
}' \
--output-dir <绝对路径>
提示技巧 — 实际有效的方法
用通俗英语描述镜头和运动。 “慢推镜头”、“固定三脚架,低角度”、“手持跟随”、“从上方吊臂移动”。将镜头描述放在前面。
每个片段一个主要动作。 不要堆砌多个竞争动作。选择一个节拍:“她转身,然后微笑”,而不是“她转身并且微笑并且一辆公交车经过并且……”。
使用 negative_prompt 处理具体问题。 好:“无字幕,无水印,无闪烁”。差(模糊):“无不良照明”。
提示扩展默认开启。 简短提示会被模型自动重写。对于简洁/字面提示(例如品牌严格的广告文案),使用 enable_prompt_expansion: false 禁用。
音频规格很重要。 audio_url 必须为 3–30 秒,≤15MB,WAV/MP3。超出范围的文件会被拒绝。音频长度应与片段时长匹配。
迭代种子。 当您希望同一提示的不同变体输出一致时,重复使用相同种子。更改种子以获得真正的多样性。
反模式:
- 静态帧描述 → 运动将模糊。
- 模糊的否定词(“无不良颜色”)→ 被忽略。
- 音频超出 3–30 秒 / 15MB / WAV-MP3 规格 → 被拒绝。
- 提示超过 5000 字符 / 1500 token → 输出质量下降。
优势场景
| 用例 | 为什么选择 Wan 2.7 |
|---|---|
| 带自定义配音的唇形同步广告 | audio_url 接受您的音轨 |
| 多语言配音变体 | 相同提示,不同语言的 audio_url |
| 多参考运动控制 | 最多 5 个参考媒体(图像/视频/语音) |
| 平滑过渡 + 运动物理 | 强大的物理感知运动先验 |
| 通过否定提示获得干净输出 | 针对性地排除问题 |
示例提示(已验证可产生强效果)
页面示例(产品展示):
产品在大理石表面上的电影级中景,柔和影棚灯光,缓慢微妙的镜头推进,
浅景深,高端商业外观,清晰的 1080p 细节
唇形同步发言人(配合 audio_url):
自信发言人在柔和照明的录音棚中的半身近景,微微倾向镜头,固定三脚架,
浅景深,来自相机左侧的暖色主光。
竖屏平台原生:
9:16 竖屏短视频。咖啡师萃取单份浓缩咖啡,蒸汽在晨光中升腾,
丰富的油脂缓慢形成。手持近景,浅景深,温暖咖啡馆氛围。
限制
- 时长上限 15 秒。 对于更长的叙事,请多次调用拼接。
- 无原生 4K — 最高 1080p。
- 宽高比 — 仅限文档中列出的 5 种值。
- 音频规格 — 仅 3–30 秒,≤15MB,WAV/MP3。
- 参考媒体上限 5 个(图像 + 视频 + 语音合计)。
- 如需内置语音生成(无需单独音频轨道),请使用 Seedance 2.0 Pro — Wan 接受音频而非生成音频。
退出码
| 代码 | 含义 |
|---|---|
| 0 | 成功 |
| 64 | CLI 参数错误 |
| 65 | 输入 JSON 错误 / 模式不匹配 |
| 69 | 上游 5xx 错误 |
| 75 | 可重试:超时 / 429 |
| 77 | 未登录或 token 被拒绝 |
完整参考:docs.runcomfy.com/cli/troubleshooting。
工作原理
该技能使用符合模式的 JSON 主体调用 runcomfy run wan-ai/wan-2-7/text-to-video。CLI 将 POST 请求发送到 https://model-api.runcomfy.net/v1/models/wan-ai/wan-2-7/text-to-video,轮询请求,获取结果,并将任何 .runcomfy.net/.runcomfy.com URL 下载到 --output-dir。Ctrl-C 在退出前取消远程请求。
安全与隐私
- Token 存储:
runcomfy login将 API token 写入~/.config/runcomfy/token.json,权限为 0600(仅所有者读写)。在 CI/容器中设置RUNCOMFY_TOKEN环境变量可完全绕过文件。 - 输入边界:用户提示通过
--input作为 JSON 字符串传递给 CLI。CLI 不会对提示进行 shell 扩展;它直接将 JSON 主体通过 HTTPS 传输到模型 API。提示内容不存在 shell 注入风险。 - 第三方内容:您传递的图像/遮罩/视频 URL 由 RunComfy 模型服务器获取,而非您机器上的 CLI。将外部 URL 视为不可信;基于图像的提示注入是任何图像编辑/视频编辑模型的已知风险。
- 出站端点:仅
model-api.runcomfy.net(请求提交)和*.runcomfy.net/*.runcomfy.com(生成输出的下载白名单)。无遥测,无回调。 - 生成文件大小上限:CLI 会中止任何超过 2 GiB 的单个下载,以防止恶意或失控模型输出导致磁盘填满。





