Skip to main content
Wan Animate 2 是 WAN 团队推出的端到端角色动画框架,可直接在重新设计的 Diffusion Transformer 中处理驱动视频。通过消除中间动作提取器,该模型实现了高保真动作生成和强大的身份保持能力:无需姿态提取或骨骼预处理。 该模型还新增了文本驱动的视角控制,将输出相机透视与驱动视频解耦。这样,你就可以使用驱动视频为静态角色制作动画,同时独立控制相机,甚至可以根据文本提示词生成全新背景。
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

模型亮点

  • 直接运动迁移:无需姿态提取或骨骼预处理,即可根据驱动视频让静态角色动起来
  • 身份保持:完整保留参考角色的身份、外观和细节
  • 文本驱动的相机控制:将输出相机透视与驱动视频解耦
  • 全新背景:根据你的文本提示生成全新背景,而非复制驱动视频中的背景
  • 高保真运动:精准复刻驱动视频中的复杂运动和表情

Wan Animate 2 工作流

使用驱动视频让静态角色动起来,直接将视频帧中的动作迁移过来。输出会保留参考角色的身份特征,同时根据你的文本提示生成全新的背景和相机运动。

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“Wan Animate 2”
输入素材 将以下文件上传到对应的节点:

参考图像

LoadImage 节点:pink_hair_mech_arms_ref.png(要制作动画的角色)

驱动视频

LoadVideo 节点:street_dance_drive.mp4(动作来源)

模型下载

此工作流使用 wan_animate_2_int8_convrot.safetensors diffusion 模型。仓库中还提供了 BF16 和蒸馏变体;如果你想使用这些变体,请在 UNETLoader 节点中更改模型选择。所有文件均可在 Comfy-Org/Wan-Animate-2 仓库中找到:

Diffusion 模型(INT8,必填)

wan_animate_2_int8_convrot.safetensors:本工作流使用的 INT8 convrot 量化 diffusion 模型

Diffusion 模型(BF16,可选)

wan_animate_2_bf16.safetensors:全精度基础模型。需要更改 UNETLoader 模型选择。

Diffusion 模型(蒸馏 INT8,可选)

wan_animate_2_distill_int8_convrot.safetensors:蒸馏 INT8 变体。需要更改 UNETLoader 模型选择。

Diffusion 模型(蒸馏 BF16,可选)

wan_animate_2_distill_bf16.safetensors:蒸馏 BF16 变体。需要更改 UNETLoader 模型选择。

LoRA

lightx2v_I2V_14B_480p_cfg_step_distill_rank64_bf16.safetensors:LightX2V 加速 LoRA

文本编码器

umt5_xxl_fp8_e4m3fn_scaled.safetensors:UMT5-XXL FP8 文本编码器

CLIP 视觉

clip_vision_h.safetensors:CLIP 视觉编码器

VAE

Wan2_1_VAE_bf16.safetensors:用于编码和解码的 Wan2.1 VAE
将文件放入以下目录:

工作流说明

  1. 确保所有模型都正确加载。
  2. 上传参考图像:该图像中的角色就是要制作动画的目标角色。
  3. 上传驱动视频:其动作会被转移到参考角色上。
  4. 更新提示词,描述你想要的场景、背景和相机运动。
  5. 点击 Run,或使用快捷键 Ctrl(cmd) + Enter 生成视频。