> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# SyncLipSyncNode - ComfyUI Built-in Node Documentation

> Complete documentation for the SyncLipSyncNode node in ComfyUI. Learn its inputs, outputs, parameters and usage.

このノードは、sync.so APIを使用して、動画内の口の動きを新しい音声に再同期します。クローズアップ、横向き、遮蔽を自動的に処理しながら、話者の表情を保持します。コストは出力時間に応じて変動します。

## 入力

| パラメータ   | 説明                                                            | データ型  | 必須 | 範囲             |
| ------- | ------------------------------------------------------------- | ----- | -- | -------------- |
| `video` | 再同期する話者の映像です。最大4K（4096x2160）まで対応し、24/25/30fpsの固定フレームレートが最適です。 | VIDEO | はい | -              |
| `audio` | 口の動きを同期させる音声です。                                               | AUDIO | はい | -              |
| `seed`  | シードはノードを再実行するかどうかを制御します。シードに関わらず結果は非決定的です（デフォルト：42）。          | INT   | はい | 0 ～ 2147483647 |
| `model` | sync.soの生成モデルです。                                              | COMBO | はい | 下記参照           |

`model`パラメータは動的なコンボであり、以下のサブパラメータを含みます：

| サブパラメータ             | 説明                                                                            | データ型  | 必須  | 範囲                                                                        |
| ------------------- | ----------------------------------------------------------------------------- | ----- | --- | ------------------------------------------------------------------------- |
| `sync_mode`         | 動画と音声の長さが一致しない場合の処理方法です。出力の長さも設定します（デフォルト："bounce"）。                          | COMBO | はい  | `"bounce"`<br />`"cut_off"`<br />`"loop"`<br />`"silence"`<br />`"remap"` |
| `speaker_selection` | 複数の人物が映っている場合に、どの顔にリップシンクを行うかを指定します（デフォルト："default"）。                         | COMBO | はい  | `"default"`<br />`"auto-detect"`<br />`"coordinates"`                     |
| `speaker_frame`     | 話者を特定するために使用する動画フレームです。`speaker_selection`が"coordinates"の場合のみ使用されます（デフォルト：0）。 | INT   | いいえ | 0 ～ 1000000                                                               |
| `speaker_x`         | 話者の顔のXピクセル座標です。`speaker_selection`が"coordinates"の場合のみ使用されます（デフォルト：0）。         | INT   | いいえ | 0 ～ 4096                                                                  |
| `speaker_y`         | 話者の顔のYピクセル座標です。`speaker_selection`が"coordinates"の場合のみ使用されます（デフォルト：0）。         | INT   | いいえ | 0 ～ 4096                                                                  |

**同期モードのオプション：**

* `bounce`：動画が最後まで再生された後、逆再生され、音声が終了するまで繰り返します（出力 = 音声の長さ）
* `loop`：動画が音声の終了まで再スタートします（出力 = 音声の長さ）
* `remap`：動画が音声に合わせて時間伸縮されます（出力 = 音声の長さ）
* `cut_off`：長い方のトラックがトリミングされます（出力 = 短い方の長さ）
* `silence`：何もトリミングされず、短い方のトラックがパディングされます（出力 = 長い方の長さ）

**話者選択のオプション：**

* `default`：モデルにリップシンクする顔を決定させます
* `auto-detect`：アクティブな話者を検出して追跡します
* `coordinates`：`speaker_frame`で選択されたフレーム内のピクセル座標（`speaker_x`、`speaker_y`）の顔をターゲットにします

**制約事項：**

* 動画の解像度は4K（4096x2160）を超えてはなりません。この制限を超える動画はエラーになります。
* 音声の長さは600秒（10分）を超えてはなりません。
* `speaker_frame`、`speaker_x`、`speaker_y`パラメータは、`speaker_selection`が"coordinates"に設定されている場合のみ使用されます。

## 出力

| 出力名     | 説明                           | データ型  |
| ------- | ---------------------------- | ----- |
| `video` | 口の動きが提供された音声に合わせて再同期された動画です。 | VIDEO |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/SyncLipSyncNode/ja.md)

***

**Source fingerprint (SHA-256):** `b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a`
