> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# SyncTalkingImageNode - ComfyUI Built-in Node Documentation

> Complete documentation for the SyncTalkingImageNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.

정지된 초상화를 음성 오디오로 구동되는 말하는 비디오로 애니메이션화합니다. sync.so의 sync-3 모델을 사용합니다. 출력 길이는 오디오 길이와 일치하며, 비용은 출력 길이에 비례합니다.

## 입력

| 매개변수                | 설명                                                                                                                                                                       | 데이터 타입  | 필수 여부 | 범위                               |
| ------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------ | ------- | ----- | -------------------------------- |
| `image`             | 얼굴이 선명하게 보이는 단일 이미지로, 최대 4K(4096x2160)까지 지원합니다.                                                                                                                          | IMAGE   | 예     | 정확히 하나의 이미지 필요                   |
| `audio`             | 말하는 비디오를 구동하는 음성 오디오입니다. 출력 길이는 이 오디오와 일치합니다. 여기에 TTS 노드를 연결하여 텍스트로 애니메이션을 구동할 수 있습니다.                                                                                   | AUDIO   | 예     | 최대 길이: 600초                      |
| `prompt`            | 초상화가 살아나는 방식에 대한 선택적 안내입니다. 예: '대상이 미소를 짓고 카메라를 바라보게 하세요'. 자연스러운 말하는 동작을 원하면 비워 둡니다. (기본값: "")                                                                           | STRING  | 아니요   | 여러 줄 텍스트                         |
| `seed`              | 시드는 노드 재실행 여부를 제어합니다. 시드와 관계없이 결과는 비결정적입니다. (기본값: 0)                                                                                                                     | INT     | 아니요   | 0 \~ 2147483647                  |
| `model`             | sync.so 생성 모델입니다. 이미지 입력은 sync-3에만 해당됩니다.                                                                                                                                | COMBO   | 예     | `"sync-3"`                       |
| `speaker_selection` | 여러 사람이 보일 때 애니메이션화할 얼굴을 선택합니다. `default`: 모델이 결정하도록 합니다. `coordinates`: 이미지 내 픽셀 좌표(speaker\_x, speaker\_y)에 있는 얼굴을 대상으로 합니다. 이미지의 경우 자동 감지는 지원되지 않습니다. (기본값: "default") | COMBO   | 아니요   | `"default"`<br />`"coordinates"` |
| `speaker_x`         | 화자의 얼굴 X 픽셀 좌표입니다. speaker\_selection이 'coordinates'인 경우에만 사용됩니다. (기본값: 0)                                                                                               | INT     | 아니요   | 0 \~ 4096                        |
| `speaker_y`         | 화자의 얼굴 Y 픽셀 좌표입니다. speaker\_selection이 'coordinates'인 경우에만 사용됩니다. (기본값: 0)                                                                                               | INT     | 아니요   | 0 \~ 4096                        |
| `auto_downscale`    | 이미지가 4K(4096x2160) 입력 제한을 초과하는 경우 자동으로 축소합니다. 화자 좌표도 이에 맞게 조정됩니다. 비활성화하면 크기가 초과된 이미지에서 오류가 발생합니다. (기본값: True)                                                            | BOOLEAN | 아니요   | True<br />False                  |

**참고:** `speaker_x` 및 `speaker_y` 매개변수는 `speaker_selection`이 `"coordinates"`로 설정된 경우에만 사용됩니다. `auto_downscale`이 활성화되면 화자 좌표가 축소된 이미지 크기에 맞게 자동으로 조정됩니다.

## 출력

| 출력 이름   | 설명                                          | 데이터 타입 |
| ------- | ------------------------------------------- | ------ |
| `video` | 입력 오디오에 동기화된 애니메이션 초상화가 포함된 생성된 말하는 비디오입니다. | VIDEO  |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncTalkingImageNode/ko.md)

***

**Source fingerprint (SHA-256):** `21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468`
