Skip to main content
Wan-Alpha は、アルファチャンネル透過性を備えた高品質な動画を生成する専用のテキストから動画を生成するモデルです。ベースモデルとして Wan2.1-14B-T2V を採用しており、透過背景および半透明オブジェクトを含む動画を生成します。合成ワークフローに最適です。 このモデルは、透過背景、半透明オブジェクト(気泡、ガラス、水)、発光エフェクト、および適切なアルファチャンネルを備えた精細なディテール(髪の毛、煙、粒子)の生成に優れています。

動画チュートリアル

リソース

ComfyUI が最新版に更新されていることを確認してください。このガイドで紹介するワークフローは、ワークフローテンプレートから入手できます。 テンプレート内に該当のワークフローが見つからない場合、ComfyUI のバージョンが古くなっている可能性があります。ワークフローを読み込んだ際にノードが欠落している場合の考えられる原因:
  1. 最新の ComfyUI(Nightly 版)を使用していない
  2. 起動時に一部のノードのインポートに失敗している

Wan-Alpha テキストから動画ワークフロー (14B)

1. ワークフローをダウンロード

ComfyUI を最新版に更新し、ワークフローファイルをダウンロードして ComfyUI にドラッグするか、テンプレートライブラリの WorkflowBrowse TemplatesVideo で “Wan 2.1 Alpha T2V 14B” を検索してください。 Wan-Alpha T2V ワークフロー

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロード、またはテンプレートライブラリで “Wan 2.1 Alpha T2V 14B” を検索

2. モデルをインストール

言及されているすべてのモデルは Wan_2.1_ComfyUI_repackaged で入手できます。 拡散モデル: いずれかのバージョンを選択:

wan2.1_t2v_14B_fp8_scaled.safetensors

FP8 スケール済み拡散モデル。ComfyUI/models/diffusion_models/ に保存

wan2.1_t2v_14B_bf16.safetensors

BF16 拡散モデル。ComfyUI/models/diffusion_models/ に保存
テキストエンコーダー

umt5_xxl_fp8_e4m3fn_scaled.safetensors

FP8 テキストエンコーダー。ComfyUI/models/text_encoders/ に保存
VAE モデル

wan_alpha_2.1_vae_rgb_channel.safetensors

RGB チャンネル VAE。ComfyUI/models/vae/ に保存

wan_alpha_2.1_vae_alpha_channel.safetensors

アルファチャンネル VAE。ComfyUI/models/vae/ に保存
LoRA モデル

wan_alpha_2.1_rgba_lora.safetensors

アルファ生成 LoRA。ComfyUI/models/loras/ に保存

lightx2v_T2V_14B_cfg_step_distill_v2_lora_rank64_bf16.safetensors

高速推論用 Lightning LoRA。ComfyUI/models/loras/ に保存
ファイル保存場所:

3. ワークフローをステップごとに完了

  1. Load Diffusion Model ノードに正しい拡散モデルが読み込まれていることを確認
  2. Load CLIP ノードに umt5_xxl_fp8_e4m3fn_scaled.safetensors が読み込まれていることを確認
  3. RGB 用の Load VAE ノードに wan_alpha_2.1_vae_rgb_channel.safetensors が読み込まれていることを確認
  4. アルファ用の 2 つ目の Load VAE ノードに wan_alpha_2.1_vae_alpha_channel.safetensors が読み込まれていることを確認
  5. LoRA Loader ノードに wan_alpha_2.1_rgba_lora.safetensors が読み込まれていることを確認
  6. (オプション)Lightning LoRA ノードに lightx2v_T2V_14B_cfg_step_distill_v2_lora_rank64_bf16.safetensors を読み込んで高速生成
  7. CLIP Text Encode (Positive Prompt) ノードでポジティブプロンプトを設定
  8. (オプション)EmptyHunyuanLatentVideo ノードで動画サイズを変更
  9. Run ボタンをクリックするか Ctrl(Cmd) + Enter で生成を実行