> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# HeyGenTalkingPhotoNode - ComfyUI Built-in Node Documentation

> Complete documentation for the HeyGenTalkingPhotoNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.

## 概述

使用 HeyGen 的 Avatar IV 技术，将人物静态图像动画化为唇形同步的说话视频。您可以通过 HeyGen 转换为语音的文本来驱动动画，也可以提供自己的音频让虚拟形象进行唇形同步。

## 输入

| 参数                | 描述                                                         | 数据类型   | 是否必填                     | 取值范围                                                                        |
| ----------------- | ---------------------------------------------------------- | ------ | ------------------------ | --------------------------------------------------------------------------- |
| `图像`              | 要动画化的人物图像。如果大于 2K 将自动缩小。                                   | IMAGE  | 是                        | -                                                                           |
| `语音`              | 通过文本脚本（HeyGen 文本转语音）或您自己的音频驱动虚拟形象。                         | COMBO  | 是                        | `"script"`<br />`"audio"`                                                   |
| `text`            | 虚拟形象要说的文本（最多 5000 个字符）。生成的语音必须至少 1 秒长。                     | STRING | 是（当 speech 为 "script" 时） | -                                                                           |
| `voice`           | 脚本使用的语音（HeyGen 最受欢迎的语音）。                                   | COMBO  | 是（当 speech 为 "script" 时） | 提供多个选项                                                                      |
| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后将覆盖上面选择的语音。可以使用 HeyGen 库中的任何语音（2000+）。 | STRING | 否                        | -                                                                           |
| `voice_speed`     | 语速倍率（默认值：1.0）。                                             | FLOAT  | 否                        | 0.5 至 1.5                                                                   |
| `audio`           | 虚拟形象唇形同步的音频，最长 10 分钟。                                      | AUDIO  | 是（当 speech 为 "audio" 时）  | -                                                                           |
| `分辨率`             | 输出视频分辨率（默认值："1080p"）。                                      | COMBO  | 否                        | `"720p"`<br />`"1080p"`                                                     |
| `宽高比`             | 输出宽高比。'auto' 跟随输入图像（默认值："auto"）。                           | COMBO  | 否                        | `"auto"`<br />`"16:9"`<br />`"9:16"`<br />`"1:1"`<br />`"4:5"`<br />`"5:4"` |
| `表现力`             | 动画面部和手势的表现力程度（默认值："low"）。                                  | COMBO  | 否                        | `"low"`<br />`"medium"`<br />`"high"`                                       |
| `种子`              | 不会发送到 HeyGen；更改它以强制重新运行（默认值：42）。                           | INT    | 否                        | 0 至 2147483647                                                              |

## 输出

| 输出名称    | 描述                     | 数据类型  |
| ------- | ---------------------- | ----- |
| `video` | 生成的动画说话照片视频，包含唇形同步的语音。 | VIDEO |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md)

***

**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a`
