モデルのハイライト
- ダイレクトモーション転送: ポーズ抽出やスケルトン前処理なしで、駆動ビデオから静止キャラクターをアニメーション化します
- アイデンティティ保持: 参照キャラクターのアイデンティティ、外観、詳細をそのまま維持します
- テキスト駆動のカメラ制御: 出力カメラのパースペクティブを駆動ビデオから切り離します
- 新しい背景: 駆動ビデオの背景をコピーする代わりに、テキストプロンプトから新しい背景を生成します
- 高忠実度のモーション: 駆動ビデオの複雑なモーションや表情を再現します
Wan Animate 2 ワークフロー
駆動ビデオを使用して静止キャラクターをアニメートし、ビデオフレームから直接モーションを転送します。出力は参照キャラクターのアイデンティティを保持しながら、テキストプロンプトから新しい背景とカメラの動きを生成します。Comfy Cloud で実行
Comfy Cloud で開く
ワークフローをダウンロード
JSONをダウンロードするか、テンプレートライブラリで「Wan Animate 2」を検索
参照画像
LoadImage ノード:pink_hair_mech_arms_ref.png(アニメートするキャラクター)駆動ビデオ
LoadVideo ノード:street_dance_drive.mp4(モーションソース)モデルのダウンロード
このワークフローはwan_animate_2_int8_convrot.safetensors Diffusion モデルを使用します。リポジトリには BF16 および蒸留バリアントも含まれています。代わりにこれらを使用したい場合は、UNETLoader ノードでモデルの選択を変更してください。すべてのファイルは Comfy-Org/Wan-Animate-2 リポジトリで入手できます:
Diffusion モデル(INT8、必須)
wan_animate_2_int8_convrot.safetensors:このワークフローで使用される INT8 convrot 量子化 Diffusion モデル
Diffusion モデル(BF16、オプション)
wan_animate_2_bf16.safetensors:フル精度ベースモデル。UNETLoader ノードのモデル選択を変更する必要があります。
Diffusion モデル(Distill INT8、オプション)
wan_animate_2_distill_int8_convrot.safetensors:蒸留 INT8 バリアント。UNETLoader ノードのモデル選択を変更する必要があります。
Diffusion モデル(Distill BF16、オプション)
wan_animate_2_distill_bf16.safetensors:蒸留 BF16 バリアント。UNETLoader ノードのモデル選択を変更する必要があります。
LoRA
lightx2v_I2V_14B_480p_cfg_step_distill_rank64_bf16.safetensors:LightX2V 高速化 LoRA
テキストエンコーダー
umt5_xxl_fp8_e4m3fn_scaled.safetensors:UMT5-XXL FP8 テキストエンコーダー
CLIP Vision
clip_vision_h.safetensors:CLIP Vision エンコーダー
VAE
Wan2_1_VAE_bf16.safetensors:エンコードおよびデコード用の Wan2.1 VAE
ワークフローの手順
- すべてのモデルが正しく読み込まれていることを確認します
- 参照画像をアップロードします:この画像内のキャラクターがアニメート対象です
- 駆動ビデオをアップロードします:そのモーションが参照キャラクターに転送されます
- プロンプトを更新して、希望するシーン、背景、カメラの動きを記述します
Runをクリックするか、ショートカットCtrl(cmd) + Enterを使用してビデオを生成します