Skip to main content
由于目前我们已经对模板做了调整,并增加了 CausVid LoRA 的相关使用及说明,本篇文档需要进行更新,还需一定准备时间,在此之前请参考模板中的备注信息进行使用

关于 VACE

VACE 14B 是阿里通义万相团队推出的开源视频编辑统一模型。该模型通过整合多任务能力、支持高分辨率处理及灵活的多模态输入机制,显著提升了视频创作的效率与质量。 该模型基于 Apache-2.0 协议开源,可用于个人或商业用途。 以下是其核心特性与技术亮点的综合分析:
  • 多模态输入:支持文本、图像、视频、遮罩、控制信号等多种输入形式
  • 统一架构:单一模型支持多种任务,可自由组合功能
  • 动作迁移:基于参考视频生成连贯动作
  • 局部替换:通过遮罩替换视频中的特定区域
  • 视频扩展:补全动作或扩展背景
  • 背景替换:保留主体更换环境背景
目前 VACE 发布了 1.3B 和 14B 两个版本,14B 版本相比 1.3B 版本,支持 720P 分辨率输出,画面细节和稳定性更好。 相关模型权重和代码仓库:

模型下载及在工作流中的加载

由于本篇文档中涉及的几个工作流都使用同一套工作流模板,所以我们可以先完成模型下载及加载的信息介绍,然后通过 Bypass 不同的节点来启用/禁用不同的输入来实现不同的工作流。 在具体示例中对应的工作流信息中已经嵌入了模型下载信息,所以你也可以在下载具体示例的工作流时来完成模型下载。

模型下载

diffusion_models wan2.1_vace_14B_fp16.safetensors wan2.1_vace_1.3B_fp16.safetensors
如果你之前使用过 Wan Video 相关的工作流,下面的模型文件你已经下载过了。
VAE Text encoders 选择一个版本进行下载 文件保存位置

模型加载

由于本指南涵盖的工作流中使用的模型一致,工作流也相同,仅通过 Bypass 不同节点来启用/禁用不同的输入,请参考以下图片,确保在不同的工作流中正确加载了相应的模型。 Wan2.1 VACE 模型加载
  1. 确保 Load Diffusion Model 节点加载了 wan2.1_vace_14B_fp16.safetensors
  2. 确保 Load CLIP 节点加载了 umt5_xxl_fp8_e4m3fn_scaled.safetensors 或者 umt5_xxl_fp16.safetensors
  3. 确保 Load VAE 节点加载了 wan_2.1_vae.safetensors

如何取消节点的 Bypass 状态

当一个节点被设置为 Bypass 状态时,通过该节点的数据将不受节点的影响,直接输出,下面是如何取消节点的 Bypass 状态的三种方法 我们通常在不需要一些节点时设置节点的 Bypass 状态,而不用将它们从节点中删除改变工作流。 取消 Bypass
  1. 选中节点后,在选择工具箱中点击标识部分的箭头,即可快速切换节点的 Bypass 状态
  2. 选中节点后,鼠标右键点击节点,选择 模式(Mode) -> 总是(Always) 切换到 Always 模式
  3. 选中节点后,鼠标右键点击节点,选择 绕过(Bypass) 选项,切换 Bypass 状态

1. VACE 文生视频

功能说明: 使用 Wan2.1 VACE 14B 模型将文本描述变换为高质量视频。支持 480p 和 720p 分辨率。

Wan2.1 VACE 文生视频

将文本描述变换为高质量视频。支持使用 VACE-14B 模型生成 480p 和 720p 分辨率的视频。 Wan2.1 VACE 文生视频工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “Wan2.1 VACE 文生视频”
如果无法从 mp4 文件加载工作流,请确保你的 ComfyUI 前端版本是 requirements.txt 中的最新版本,以确保你能够从 mp4 文件加载工作流。目前 1.19.9 是 requirements.txt 文件中的最新 ComfyUI 前端版本。

运行步骤

图像 请按照图片中的编号步骤操作,以确保工作流顺利执行:
  1. CLIP Text Encode (Positive Prompt) 节点中输入正向提示词
  2. CLIP Text Encode (Negative Prompt) 节点中输入负面提示词
  3. WanVaceToVideo 节点中设置图像尺寸(首次运行推荐使用 640x640 分辨率)和帧数(视频时长)
  4. 点击 Run 按钮,或使用快捷键 Ctrl(cmd) + Enter(回车) 执行视频生成
  5. 生成完成后,视频将自动保存到 ComfyUI/output/video 目录下(子文件夹位置取决于 save video 节点的设置)
在测试过程中,使用 4090 显卡:
  • 720x1280 分辨率,生成 81 帧大约需要 40 分钟
  • 640x640 分辨率,生成 49 帧大约需要 7 分钟
不过,720P 的视频质量会更好。

VACE 图生视频工作流

你可以继续使用上面的工作流文件,只需要将 Load reference imageLoad image 节点的 Bypass 取消,并输入对应的图片,你也可以使用下面的图片,在这个文件里,我们已经完成了对应的参数设置。

1. 工作流下载

下载下面的视频,并拖入 ComfyUI 中,以加载对应的工作流 请下载下面图片作为输入图片 vace-i2v-input

2. 按步骤完成工作流的运行

工作流步骤图 请参照图片序号进行逐步确认,来保证对应工作流的顺利运行
  1. Load image 节点中输入对应的图片
  2. 你可以像文生图工作流一样完成提示词的修改和编辑
  3. WanVaceToVideo 设置对应图像的尺寸(首次运行建议设置 640*640 的分辨率),帧数(视频的时长)
  4. 点击 Run 按钮,或者使用快捷键 Ctrl(cmd) + Enter(回车) 来执行视频生成
  5. 生成完成后对应的视频会自动保存到 ComfyUI/output/video 目录下(子文件夹位置取决于 save video 节点设置)
你可能会使用类似获取图片尺寸的节点来设置对应的分辨率,但是由于对应节点有宽度和高度的步长要求,如果你的图片尺寸无法被 16 整除,可能会出现报错提示。

3. 工作流补充说明

VACE 还支持在一张图像中输入多个参考图像,来生成对应的视频,你可以在 VACE 的项目页中看到相关的示例

3. VACE 视频转视频

功能说明: 使用 Wan VACE 通过控制输入视频和参考图像来生成视频。通过参考素材控制视频的风格和动作。

Wan2.1 VACE 控制视频

使用 Wan VACE 通过控制输入视频和参考图像来生成视频。 Wan2.1 VACE 控制视频工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “Wan2.1 VACE Control Video”
我们将使用以下素材作为输入:

参考图像

输入参考图像,用于提供风格和内容。

控制视频(已预处理)

已预处理的深度控制视频。可直接在 Load control video 下的 Load Video 节点中使用。
  1. 用于参考的输入图像:
v2v-input
  1. 下面的视频已经过预处理,将用于控制视频生成:
  1. 下面的视频是原始视频。你可以下载这些素材,并使用类似 comfyui_controlnet_aux 的预处理节点对图像进行预处理:

运行步骤

工作流步骤 请按照图中的编号步骤操作,以确保工作流顺利执行:
  1. Load reference image 下的 Load Image 节点中输入参考图像
  2. Load control video 下的 Load Video 节点中输入控制视频。由于提供的视频已经过预处理,无需进行额外处理
  3. 如果你需要自行预处理原始视频,可以修改 Image preprocessing 分组,或使用 comfyui_controlnet_aux 节点来完成预处理
  4. 修改提示词
  5. WanVaceToVideo 中设置图像尺寸(首次运行推荐使用 640x640 分辨率)和帧数(视频时长)
  6. 点击 Run 按钮,或使用快捷键 Ctrl(cmd) + Enter 来执行视频生成
  7. 生成后,视频将自动保存到 ComfyUI/output/video 目录(子文件夹位置取决于 save video 节点设置)

4. VACE Inpainting

功能: 编辑视频中的特定区域,同时保留周围内容。非常适合用于物体移除或替换。

Wan2.1 VACE Inpainting

编辑视频中的特定区域,同时保留周围内容。非常适合用于物体移除或替换。 Wan2.1 VACE Inpainting 工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“Wan2.1 VACE Inpainting”
输入素材

输入视频

用于 inpainting 的输入视频。请在 Load Video 节点中加载。

首帧与遮罩

带遮罩叠加的首帧,用于标记 inpainting 区域。

参考图像

用于 inpainting 内容的参考图像。
[待更新]

5. VACE 视频外扩

功能说明: 使用 Wan VACE 外扩功能,扩展视频尺寸以生成扩展视频。

Wan2.1 VACE 外扩

使用 Wan VACE 外扩功能,扩展视频尺寸以生成扩展视频。 Wan2.1 VACE 外扩工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “Wan2.1 VACE Outpainting”
输入素材

输入视频

用于外扩的输入视频。在 加载视频 节点中加载。
[待更新]

6. VACE 首尾帧视频生成

功能: 通过定义起始帧和结束帧来生成平滑的视频过渡效果。支持自定义关键帧序列。

Wan2.1 VACE 首尾帧

通过定义起始帧和结束帧来生成平滑的视频过渡效果。支持自定义关键帧序列。 Wan2.1 VACE 首尾帧工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“Wan2.1 VACE First-Last Frame”
输入素材

起始帧

起始帧图像。在 Load Image 节点中加载。

结束帧

结束帧图像。在 Load Image 节点中加载。
为确保起始帧和结束帧生效,视频的 length 设置必须满足 length-1 能被 4 整除。 对应的 Batch_size 设置必须满足 Batch_size = length - 2 [待更新]