Skip to main content
このノードは、sync.so APIを使用して、動画内の口の動きを新しい音声に再同期します。クローズアップ、横向き、遮蔽を自動的に処理しながら、話者の表情を保持します。コストは出力時間に応じて変動します。

入力

modelパラメータは動的なコンボであり、以下のサブパラメータを含みます: 同期モードのオプション:
  • bounce:動画が最後まで再生された後、逆再生され、音声が終了するまで繰り返します(出力 = 音声の長さ)
  • loop:動画が音声の終了まで再スタートします(出力 = 音声の長さ)
  • remap:動画が音声に合わせて時間伸縮されます(出力 = 音声の長さ)
  • cut_off:長い方のトラックがトリミングされます(出力 = 短い方の長さ)
  • silence:何もトリミングされず、短い方のトラックがパディングされます(出力 = 長い方の長さ)
話者選択のオプション:
  • default:モデルにリップシンクする顔を決定させます
  • auto-detect:アクティブな話者を検出して追跡します
  • coordinatesspeaker_frameで選択されたフレーム内のピクセル座標(speaker_xspeaker_y)の顔をターゲットにします
制約事項:
  • 動画の解像度は4K(4096x2160)を超えてはなりません。この制限を超える動画はエラーになります。
  • 音声の長さは600秒(10分)を超えてはなりません。
  • speaker_framespeaker_xspeaker_yパラメータは、speaker_selectionが”coordinates”に設定されている場合のみ使用されます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a