> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# ComfyUI Wan2.1 InfiniteTalk 工作流示例

> InfiniteTalk 是基于 Wan2.1 构建的音频驱动全身视频配音模型，可实现角色唇形与身体动作同任意输入音频的同步。

**Wan2.1 InfiniteTalk** 是一个基于 Wan2.1 构建的开源音频驱动视频生成模型，由 [MeiGen-AI](https://github.com/MeiGen-AI/InfiniteTalk) 开发。它支持根据单张参考图像和音频输入生成全身说话视频。角色的口型动作和身体动作会自动同步，以匹配所提供的音频。

**主要功能**：

* **音频驱动口型同步**：生成与输入音频相匹配的自然口型动作
* **全身动作**：在保留身份、背景和相机运动的同时，添加同步的身体动作
* **双模式**：同时支持单角色和多角色场景
* **ComfyUI 原生支持**：内置 `WanInfiniteTalkToVideo` 节点，无需自定义节点

**相关链接**：

* [InfiniteTalk GitHub 仓库](https://github.com/MeiGen-AI/InfiniteTalk)
* [Wan2.1 代码仓库](https://github.com/Wan-Video/Wan2.1)
* [Wan2.1 模型仓库](https://huggingface.co/Wan-AI)

<Card title="了解子图" icon="book-open" href="/zh/interface/features/subgraph">
  此工作流使用子图节点进行模块化处理。请查看子图文档，了解如何自定义和扩展该工作流。
</Card>

## InfiniteTalk 图生视频工作流

<CardGroup cols={2}>
  <Card title="在 Comfy Cloud 中运行" icon="cloud" href="https://cloud.comfy.org/?template=video_wan2_1_infinitetalk&utm_source=docs&utm_medium=referral&utm_campaign=wan2-1-infinitetalk">
    在 Comfy Cloud 中打开
  </Card>

  <Card title="下载工作流" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_wan2_1_infinitetalk.json">
    下载 JSON，或在模板库中搜索 "InfiniteTalk"
  </Card>
</CardGroup>

![Wan2.1 InfiniteTalk 工作流预览](https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/templates/video_wan2_1_infinitetalk-1.webp)

<Tip>
  <Tabs>
    <Tab title="本地用户">
      请确保你的 ComfyUI 已经更新。

      * [ComfyUI 下载](https://www.comfy.org/download)
      * [ComfyUI 更新教程](/zh/installation/update_comfyui)

      本指南里的工作流可以在[工作流模板](/zh/interface/features/template)中找到。如果找不到，可能是 ComfyUI 没有更新。

      如果加载工作流时有节点缺失，可能原因有：

      1. 你用的不是最新版（每夜版）。
      2. 启动时有些节点导入失败。
    </Tab>

    <Tab title="云端用户">
      * [Cloud](https://cloud.comfy.org) 会在 ComfyUI 稳定版本发布后更新。

      所以，如果你发现本文档中有任何核心节点缺失，可能是因为新核心节点尚未在最新稳定版中发布。请等待下一个稳定版发布。
    </Tab>
  </Tabs>
</Tip>

## 模型安装

需要下载以下模型并将其放入正确的目录：

**diffusion\_models**

* [Wan2\_1-I2V-14B-480p\_fp8\_e4m3fn\_scaled\_KJ.safetensors](https://huggingface.co/Kijai/WanVideo_comfy_fp8_scaled/resolve/main/I2V/Wan2_1-I2V-14B-480p_fp8_e4m3fn_scaled_KJ.safetensors)

**text\_encoders**

* [umt5\_xxl\_fp8\_e4m3fn\_scaled.safetensors](https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/resolve/main/split_files/text_encoders/umt5_xxl_fp8_e4m3fn_scaled.safetensors)

**model\_patches**

* [wan2.1\_infiniteTalk\_single\_fp16.safetensors](https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/resolve/main/split_files/model_patches/wan2.1_infiniteTalk_single_fp16.safetensors)：适用于单角色场景
* [wan2.1\_infiniteTalk\_multi\_fp16.safetensors](https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/resolve/main/split_files/model_patches/wan2.1_infiniteTalk_multi_fp16.safetensors)：适用于多角色场景

**audio\_encoders**

* [wav2vec2-chinese-base\_fp16.safetensors](https://huggingface.co/Kijai/wav2vec2_safetensors/resolve/main/wav2vec2-chinese-base_fp16.safetensors)

**vae**

* [Wan2\_1\_VAE\_bf16.safetensors](https://huggingface.co/Kijai/WanVideo_comfy/resolve/main/Wan2_1_VAE_bf16.safetensors)

**loras**

* [lightx2v\_I2V\_14B\_480p\_cfg\_step\_distill\_rank64\_bf16.safetensors](https://huggingface.co/Kijai/WanVideo_comfy/resolve/main/Lightx2v/lightx2v_I2V_14B_480p_cfg_step_distill_rank64_bf16.safetensors)

### 模型存放位置

```
📂 ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │   └── Wan2_1-I2V-14B-480p_fp8_e4m3fn_scaled_KJ.safetensors
│   ├── 📂 text_encoders/
│   │   └── umt5_xxl_fp8_e4m3fn_scaled.safetensors
│   ├── 📂 model_patches/
│   │   ├── wan2.1_infiniteTalk_single_fp16.safetensors
│   │   └── wan2.1_infiniteTalk_multi_fp16.safetensors
│   ├── 📂 audio_encoders/
│   │   └── wav2vec2-chinese-base_fp16.safetensors
│   ├── 📂 vae/
│   │   └── Wan2_1_VAE_bf16.safetensors
│   └── 📂 loras/
│       └── lightx2v_I2V_14B_480p_cfg_step_distill_rank64_bf16.safetensors
```

### 示例输入文件

下载这些示例输入文件，并将它们拖入对应的节点：

<CardGroup cols={2}>
  <Card title="下载示例图像" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/two_character_talking.png">
    角色参考图像
  </Card>

  <Card title="下载说话人 1 音频" icon="music" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/audio_speaker1_woman.mp3">
    角色 1 的音频轨道
  </Card>

  <Card title="下载说话人 2 音频" icon="music" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/audio_speaker2_man.mp3">
    角色 2 的音频轨道
  </Card>
</CardGroup>

## 工作流步骤

1. **加载输入图像**：将角色参考图像拖拽到 `Load Image` 节点。对于多角色场景，使用遮罩编辑器为每个角色绘制遮罩。
2. **加载音频轨道**：将音频文件连接到 `Load Audio` 节点（每个角色一个）。
3. **加载扩散模型**：确保 `Load Diffusion Model` 节点使用的是 `Wan2_1-I2V-14B-480p_fp8_e4m3fn_scaled_KJ.safetensors`。
4. **加载模型补丁**：通过 `ModelPatchLoader` 节点加载相应的 InfiniteTalk 补丁（`single` 或 `multi` 变体）。
5. **配置 InfiniteTalk**：调整 `WanInfiniteTalkToVideo` 节点的参数，例如 `length`（视频长度，以帧为单位）、`motion_frame_count`（用作运动上下文的之前帧数）以及 `audio_scale`。
6. **生成**：运行工作流。模型将生成与输入音频同步的全身说话视频。

### 扩展视频长度

每个 **Video Extend** 组会将视频延长约 3.24 秒（25 fps 下的 81 帧）。如果你的音频更长，可以：

1. 框选 "Video Extend" 组
2. 按 `Ctrl-C`（复制），然后按 `Ctrl-Shift-V`（带连线粘贴）
3. 将上一个 `InfiniteTalk (Base Generation)` 节点的 `IMAGE` 输出连接到新的 `WanInfiniteTalkToVideo` 节点的 `previous_frames` 输入
4. 将 `Batch Images` 节点的 `IMAGE` 输出连接到新的 `Batch Images` 节点的图像输入


This documentation is built and hosted on [Mintlify](https://mintlify.com), a developer documentation platform.