Skip to main content
Wan2.2-Fun-Control は、Alibaba PAI チームによってリリースされた次世代の動画生成・制御モデルです。革新的な Control Codes メカニズムを導入し、深層学習とマルチモーダル条件入力を組み合わせることで、事前設定された制御条件に準拠した高品質な動画を生成できます。本モデルは Apache 2.0 ライセンス でリリースされており、商用利用も可能です。 主な機能:
  • マルチモーダル制御: Canny(線画)Depth(深度)OpenPose(人体ポーズ)MLSD(幾何学的エッジ)、および軌跡制御を含む複数の制御条件をサポート
  • 高品質動画生成: Wan2.2 アーキテクチャに基づき、映画レベルの品質の動画を出力
  • 多言語サポート: 中国語や英語を含む多言語プロンプトをサポート
以下は関連モデル重みとコードリポジトリです:

ComfyOrg Wan2.2 Fun InP & Control YouTube ライブストリームリプレイ

Wan2.2 Fun Control ビデオ生成ワークフローの例

ComfyUI が最新版に更新されていることを確認してください。このガイドで紹介するワークフローは、ワークフローテンプレートから入手できます。 テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因:
  1. 最新の ComfyUI(Nightly 版)を使用していない
  2. 起動時に一部のノードのインポートに失敗している
このワークフローには2つのバージョンがあります。
  1. lightx2v の Wan2.2-Lightning 4ステップLoRAを使用したバージョン:ビデオのダイナミクスが一部失われる可能性がありますが、より高速です。
  2. 高速化LoRAを使用しない fp8_scaled バージョン
以下は、RTX4090D 24GB VRAM GPU、640×640 解像度、81フレームでのテスト結果です。 4ステップLoRAを使用すると、初めてワークフローを試すユーザーにとってより良い体験が得られますが、ビデオのダイナミクスが一部失われる可能性があるため、デフォルトでは高速化LoRAバージョンを有効にしています。もう一方のワークフローを有効にするには、それを選択して Ctrl+B でアクティブにしてください。

1. ワークフローと素材のダウンロード

ComfyUI を最新バージョンに更新し、ワークフローファイルをダウンロードして ComfyUI にドラッグ&ドロップするか、テンプレートライブラリで WorkflowBrowse TemplatesVideo から「Wan2.2 Fun Control」を検索してください。 Wan2.2 Fun Control ワークフロー

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロードするか、テンプレートライブラリで「Wan2.2 Fun Control」を検索してください
以下の画像と動画を入力素材としてダウンロードしてください。 入力素材

video_wan2_2_14B_fun_control_start_image.jpg

ビデオ生成の開始フレーム。この画像をダウンロードして使用するか、ご自身の画像に置き換えてください。

video_wan2_2_14B_fun_control_start_image_control_video.mp4

前処理済みのポーズ制御ビデオ。このビデオをダウンロードして使用するか、ご自身のビデオに置き換えてください。
ここでは前処理済みのビデオを使用しています。

2. モデル

このガイドで使用するすべてのモデルはこちらから入手できます。 拡散モデル

Wan2.2 Fun Control High Noise 14B FP8

wan2.2_fun_control_high_noise_14B_fp8_scaled.safetensors: ハイノイズ拡散モデル

Wan2.2 Fun Control Low Noise 14B FP8

wan2.2_fun_control_low_noise_14B_fp8_scaled.safetensors: ローノイズ拡散モデル
Wan2.2-Lightning LoRA(オプション、高速化用)

ハイノイズ4ステップLoRA

wan2.2_i2v_lightx2v_4steps_lora_v1_high_noise.safetensors: ハイノイズ4ステップ高速化LoRA

ローノイズ4ステップLoRA

wan2.2_i2v_lightx2v_4steps_lora_v1_low_noise.safetensors: ローノイズ4ステップ高速化LoRA
VAE

Wan2.1 VAE

wan_2.1_vae.safetensors: エンコード/デコード用のWan2.1 VAE
テキストエンコーダ

UMT5 XXL FP8 Scaled

umt5_xxl_fp8_e4m3fn_scaled.safetensors: スケーリングされたFP8テキストエンコーダ

3. ワークフローガイド

Wan2.2 Fun Control Workflow Steps
このワークフローはLoRAを使用します。対応する拡散モデルとLoRAが一致していることを確認してください。高ノイズモデルと低ノイズモデル、およびLoRAは対応して使用する必要があります。
  1. 高ノイズモデルとLoRAの読み込み
    • Load Diffusion Modelノードがwan2.2_fun_control_high_noise_14B_fp8_scaled.safetensorsモデルを読み込んでいることを確認してください
    • LoraLoaderModelOnlyノードがwan2.2_i2v_lightx2v_4steps_lora_v1_high_noise.safetensorsを読み込んでいることを確認してください
  2. 低ノイズモデルとLoRAの読み込み
    • Load Diffusion Modelノードがwan2.2_fun_control_low_noise_14B_fp8_scaled.safetensorsモデルを読み込んでいることを確認してください
    • LoraLoaderModelOnlyノードがwan2.2_i2v_lightx2v_4steps_lora_v1_low_noise.safetensorsを読み込んでいることを確認してください
  3. Load CLIPノードがumt5_xxl_fp8_e4m3fn_scaled.safetensorsモデルを読み込んでいることを確認してください
  4. Load VAEノードがwan_2.1_vae.safetensorsモデルを読み込んでいることを確認してください
  5. Load Imageノードで開始フレームをアップロードしてください
  6. 2番目のLoad videoノードでポーズ制御ビデオを読み込んでください。提供されたビデオは前処理済みで、そのまま使用できます
  7. 前処理済みのポーズビデオを提供しているため、対応するビデオ画像前処理ノードを無効にする必要があります。ノードを選択し、Ctrl + Bで無効にできます
  8. プロンプトを変更:中国語と英語の両方を使用できます
  9. Wan22FunControlToVideoでビデオの寸法を変更します。デフォルトは640×640解像度に設定されており、VRAMが少ないユーザーの処理時間が過度にならないようにしています
  10. Runボタンをクリックするか、ショートカットCtrl(cmd) + Enterを使用してビデオ生成を実行します

補足説明

ComfyUIの組み込みノードにはCannyプリプロセッサしか含まれていないため、他の種類の画像前処理を実装するには ComfyUI-comfyui_controlnet_aux のようなツールを使用できます。