Skip to main content
Vidu Q4 Preview は Vidu のビデオ生成モデルで、ComfyUI では2つのパートナーノードを通じて利用できます。3秒から16秒のクリップをネイティブオーディオ付きで生成するため、映像、セリフ、サウンドエフェクトがすべて1回の処理でモデルから出力されます。出力は540pから4Kまで対応します。 ComfyUI では、Vidu Q4 Image-to-Video Generation は単一の最初のフレームを任意のプロンプトで動画化し、Vidu Q4 Reference-to-Video Generation は最大15枚の参照画像、任意の参照オーディオ、プロンプトからクリップを構築します。どちらもクラウド APIノードで、クレジット付きの Comfy アカウントが必要となり、ローカルモデルのダウンロードは発生しません。1秒あたりの料金については パートナーノードの料金 を参照してください。 画像から動画へは入力画像のアスペクト比を維持します。参照から動画は明示的な aspect_ratio を受け取り、両方のノードが duration、resolution、audio トグルを公開しています。

利用可能なワークフロー

画像から動画へ

1枚の画像をアニメートします。画像がクリップの最初のフレームとなり、出力はそのアスペクト比を維持するため、別の形状が必要な場合は画像をクロップしてください。プロンプトは任意で、ショット内で何が起こるかを記述します。 Vidu Q4 Preview 画像から動画へのワークフロープレビュー

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロードするか、テンプレートライブラリで「Vidu Q4 Preview: Image to Video」を検索してください
入力マテリアル

model_turquoise_yellow_outfit.png

Vidu Q4 Image-to-Video ノードに渡す LoadImage ノードに読み込んでください

参照から動画へ

参照画像、任意の参照オーディオ、そしてプロンプトからクリップを構築します。最大15枚の参照画像と最大3つのオーディオクリップを接続し、プロンプト内で順番に指定します: image 1、image 2、以降同様です。テンプレートでは2枚の参照画像を使用して、キャラクターと小道具をショット全体で一貫させています。 Vidu Q4 Preview 参照から動画へのワークフロープレビュー

Comfy Cloud で実行

Comfy Cloud で開く

ワークフローをダウンロード

JSON をダウンロードするか、テンプレートライブラリで「Vidu Q4 Preview: Reference to Video」を検索してください
入力マテリアル

clay_man_smiley_sweater.png

2番目の参照画像スロットに読み込んでください · image 2

yellow_fuzzy_smiley.png

最初の参照画像スロットに読み込んでください · image 1

ワークフロー概要

どちらのテンプレートも小さなグラフを使用します:
  • LoadImage: 最初のフレーム(画像から動画へ)または参照画像(参照から動画へ)を提供します
  • Vidu4ImageToVideoNode / Vidu4ReferenceVideoNode: コアノードで、Vidu Q4 Preview モデルで設定されています
  • SaveVideo: 完成したクリップを書き出します

実行手順

  1. 入力を読み込む: 画像から動画へでは最初のフレームを、参照から動画へでは参照画像を設定します
  2. モデルを選択: ノード上で Vidu Q4 Preview を維持します
  3. 解像度と再生時間を選択: 540p から 4K まで、そして3〜16秒
  4. オーディオを切り替え: オンのままにするとセリフやサウンドエフェクトを保持し、オフにすると無音のクリップになります
  5. Queue をクリックするか Ctrl+Enter を押して生成します

ノードのコントロール

プロンプトのヒント

  • ショット、セリフ、サウンドを記述する。モデルは映像とオーディオを同時にレンダリングするため、アクション、引用符で囲んだセリフ、そして環境音を同じプロンプトに書きます。
  • 参照は順番で指定する。参照画像は image 1、image 2 として扱われます。それぞれが何を保持すべきかを指定します。たとえば、image 1 からキャラクターの顔と服装を保持する、などです。
  • 音声参照用に対話を書く。参照オーディオは言葉ではなく声を伝えるため、プロンプトにセリフを書き、声を指定します。たとえば、image 1 says "Welcome back!" in the voice from audio 1 のようにします。
  • アスペクト比を許容範囲内に保つ。参照画像は 1:5 から 5:1 の間でなければなりません。
  • 実行ごとの変動を想定する。シードは結果を固定しません。同じ設定でも異なる結果が生成されることがあります。

はじめる

  1. ComfyUIを最新バージョンにアップデートする
  2. テンプレートライブラリに移動し、Vidu Q4 Preview を検索する