Skip to main content
Vidu Q4 Preview 是 Vidu 推出的视频生成模型,在 ComfyUI 中通过两个合作节点提供。它能生成 3 至 16 秒、带原生音频的片段,画面、对白和音效都由模型在单次生成中一并产出。输出分辨率从 540p 到 4K。 在 ComfyUI 中,Vidu Q4 Image-to-Video Generation 可依据单张首帧图像并配合可选提示词生成动画,Vidu Q4 Reference-to-Video Generation 则可基于最多 15 张参考图像、可选的参考音频和提示词生成片段。两者都是云端 API 节点:需要带积分的 Comfy 账户,不会下载任何本地模型。每秒计费标准请参见合作伙伴节点定价。 图生视频会保持输入图像的宽高比。参考生视频需要显式指定 aspect_ratio,两个节点都提供 duration、resolution 以及 audio 开关。

可用工作流

图生视频

为一张图像制作动画。该图像是视频片段的首帧,输出会保持其宽高比,因此当你需要不同的形状时,请裁剪图像。提示词为可选,用于描述镜头中发生的内容。 Vidu Q4 Preview 图生视频工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“Vidu Q4 Preview: Image to Video”
输入素材

model_turquoise_yellow_outfit.png

加载到为 Vidu Q4 图生视频节点提供输入的 LoadImage 节点中

参考生视频

使用参考图像、可选的参考音频和提示词构建视频片段。最多可连接 15 张参考图像和 3 段音频,然后在提示词中按顺序引用它们:image 1、image 2,依此类推。该模板使用两张参考图像,以在整个镜头中保持角色和道具的一致性。 Vidu Q4 Preview 参考生视频工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“Vidu Q4 Preview: Reference to Video”
输入素材

clay_man_smiley_sweater.png

加载到第二个参考图像槽位 · image 2

yellow_fuzzy_smiley.png

加载到第一个参考图像槽位 · image 1

工作流总览

两个模板都使用一个小型节点图:
  • LoadImage:提供首帧(图生视频)或参考图像(参考生视频)
  • Vidu4ImageToVideoNode / Vidu4ReferenceVideoNode:核心节点,配置为使用 Vidu Q4 Preview 模型
  • SaveVideo:写入已完成的视频片段

运行步骤

  1. 加载输入:为图生视频设置首帧,或为参考生视频设置参考图像
  2. 选择模型:在节点上保留 Vidu Q4 Preview
  3. 选择分辨率和时长:从 540p 到 4K,时长 3 到 16 秒
  4. 切换音频:保持开启可保留对话和音效,关闭则生成静音视频片段
  5. 点击 Queue 或按 Ctrl+Enter 生成

节点控件

提示词技巧

  • 描述镜头、台词和声音。模型会同时渲染画面和音频,因此请在同一提示词中写出动作、加引号的台词以及环境声。
  • 按顺序标注参考。参考图像以 image 1、image 2 的方式引用。请说明每个参考需要保留什么,例如从 image 1 中保留角色的脸和服装。
  • 为声音参考编写对白。参考音频承载的是音色而不是词句,所以请在提示词中写出台词,并把它指向某个音色,例如 image 1 says "Welcome back!" in the voice from audio 1。
  • 让宽高比保持在允许范围内。参考图像的比例必须介于 1:5 和 5:1 之间。
  • 不同运行之间会有差异。种子不会锁定结果;相同的设置仍可能生成不同的演绎。

开始使用

  1. 将 ComfyUI 更新到最新版本
  2. 前往模板库,搜索 Vidu Q4 Preview