Skip to main content
このノードは、LTXV-AV モデルにクロスモーダル(オーディオ-ビデオ)ガイダンスを適用します。サンプリング中、オーディオからビデオ、およびビデオからオーディオへのクロスアテンション接続を無効にした状態で、各ステップにつき1回追加のフォワードパスを実行し、その結果を結合された予測に近づけるように調整します。これにより、リップシンクなどのオーディオとビデオの同期が強化されます。modality_scale の参照デフォルト値は 3.0 です。1.0 に設定すると、追加のフォワードパスが無効になります。

入力

ガイダンスは、シグマ値が start_percentend_percent で定義された範囲内にあるサンプリングステップにのみ適用されます。この範囲外では、ノードはノイズ除去された結果を変更せずに返します。また、modality_scale を1.0に設定すると、追加のフォワードパス全体が無効になります。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 038be607c42e626a8a8f5fe336ee466d0847d43835edb71e20ff38f668069cfb