aspect_ratio,两个节点都提供 duration、resolution 以及 audio 开关。
可用工作流
图生视频
为一张图像制作动画。该图像是视频片段的首帧,输出会保持其宽高比,因此当你需要不同的形状时,请裁剪图像。提示词为可选,用于描述镜头中发生的内容。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“Vidu Q4 Preview: Image to Video”
model_turquoise_yellow_outfit.png
加载到为 Vidu Q4 图生视频节点提供输入的
LoadImage 节点中参考生视频
使用参考图像、可选的参考音频和提示词构建视频片段。最多可连接 15 张参考图像和 3 段音频,然后在提示词中按顺序引用它们:image 1、image 2,依此类推。该模板使用两张参考图像,以在整个镜头中保持角色和道具的一致性。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“Vidu Q4 Preview: Reference to Video”
clay_man_smiley_sweater.png
加载到第二个参考图像槽位 ·
image 2yellow_fuzzy_smiley.png
加载到第一个参考图像槽位 ·
image 1工作流总览
两个模板都使用一个小型节点图:- LoadImage:提供首帧(图生视频)或参考图像(参考生视频)
- Vidu4ImageToVideoNode / Vidu4ReferenceVideoNode:核心节点,配置为使用
Vidu Q4 Preview模型 - SaveVideo:写入已完成的视频片段
运行步骤
- 加载输入:为图生视频设置首帧,或为参考生视频设置参考图像
- 选择模型:在节点上保留
Vidu Q4 Preview - 选择分辨率和时长:从
540p到4K,时长 3 到 16 秒 - 切换音频:保持开启可保留对话和音效,关闭则生成静音视频片段
- 点击 Queue 或按
Ctrl+Enter生成
节点控件
提示词技巧
- 描述镜头、台词和声音。模型会同时渲染画面和音频,因此请在同一提示词中写出动作、加引号的台词以及环境声。
- 按顺序标注参考。参考图像以
image 1、image 2的方式引用。请说明每个参考需要保留什么,例如从image 1中保留角色的脸和服装。 - 为声音参考编写对白。参考音频承载的是音色而不是词句,所以请在提示词中写出台词,并把它指向某个音色,例如
image 1 says "Welcome back!" in the voice from audio 1。 - 让宽高比保持在允许范围内。参考图像的比例必须介于 1:5 和 5:1 之间。
- 不同运行之间会有差异。种子不会锁定结果;相同的设置仍可能生成不同的演绎。
开始使用
- 将 ComfyUI 更新到最新版本
- 前往模板库,搜索
Vidu Q4 Preview