入力
modelパラメータは動的なコンボであり、以下のサブパラメータを含みます:
同期モードのオプション:
bounce:動画が最後まで再生された後、逆再生され、音声が終了するまで繰り返します(出力 = 音声の長さ)loop:動画が音声の終了まで再スタートします(出力 = 音声の長さ)remap:動画が音声に合わせて時間伸縮されます(出力 = 音声の長さ)cut_off:長い方のトラックがトリミングされます(出力 = 短い方の長さ)silence:何もトリミングされず、短い方のトラックがパディングされます(出力 = 長い方の長さ)
default:モデルにリップシンクする顔を決定させますauto-detect:アクティブな話者を検出して追跡しますcoordinates:speaker_frameで選択されたフレーム内のピクセル座標(speaker_x、speaker_y)の顔をターゲットにします
- 動画の解像度は4K(4096x2160)を超えてはなりません。この制限を超える動画はエラーになります。
- 音声の長さは600秒(10分)を超えてはなりません。
speaker_frame、speaker_x、speaker_yパラメータは、speaker_selectionが”coordinates”に設定されている場合のみ使用されます。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
b41f8c9bf0d55059f081a66af20636ec96462c3fd9caeb685cab10278f84678a