> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# FastVideo FastH3：ComfyUI ワークフロー例

> FastVideo FastH3 ディスティルドチェックポイントを使い、ComfyUI で 8 サンプリングステップで同期オーディオ付きの MiniMax H3 動画を生成します。テキストから動画、最初と最後のフレームワークフローに対応。

[FastVideo FastH3](https://huggingface.co/FastVideo/FastVideo-FastH3-8-Step-V2) は、FastVideo チームが MiniMax H3 を DMD2 で蒸留したチェックポイントで、ベースモデルの完全なスケジュールの代わりに **8 サンプリングステップ**でネイティブ同期オーディオ付きの動画を生成します。H3 のテキストエンコーダー、動画 VAE、オーディオ VAE をそのまま使うため、出力設定はベースモデルと同じままで、サンプリングだけが大幅に短縮されます。

FastH3 プレビューは Nuva Lab と NVIDIA FastGen チームとの共同開発によるものです。蒸留の詳細は [FastH3 発表記事](https://haoailab.com/blogs/fasth3-preview/) を参照してください。ComfyUI に同梱されているのは 8 ステップ V2 チェックポイントで、Comfy-Org が [FastVideo-FastH3-Comfy](https://huggingface.co/FastVideo/FastVideo-FastH3-Comfy) リポジトリで再パッキングしました。

FastH3 は、動きとオーディオの忠実度をいくらか犠牲にして速度を得るモデルです。ドラフト、反復、短時間での仕上げに適しています。最高品質が必要な場合はベースの MiniMax H3 ワークフローを使用してください。

<UpdateReminder />

<Note>
  この蒸留チェックポイントはテキストから動画、最初と最後のフレームによる画像から動画のみに対応しています。Ref2VA（マルチリファレンス条件付け）は蒸留されていません。リファレンスベースの生成にはベースの [MiniMax H3 ワークフロー](/ja/tutorials/video/minimax/minimax-h3-native) を使用してください。
</Note>

## 要件

* ComfyUI 0.36.0 以降
* MiniMax H3 のテキストエンコーダーと VAE（ベースモデルと共通、下記の一覧を参照）

## FastH3 テキストから動画

テキストプロンプトから 8 ステップで同期オーディオ付きの動画を生成します。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_fastvideo_fasth3_t2v.mp4" />

<CardGroup cols={2}>
  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_fastvideo_fasth3_t2v.json">
    JSON をダウンロード、またはテンプレートライブラリで "FastVideo FastH3: Text to Video" を検索
  </Card>
</CardGroup>

### プロンプトのコツ

1. **シーン全体を説明する**: まず全体のシーン（場所、キャラクター、何が起きているか）を述べ、次に時間順のショットに分割します
2. **ショット・カメラ・オーディオ**: ショット、カメラワーク、伴奏オーディオ（セリフ、効果音、音楽）を 1 つのプロンプトブロックで記述します
3. **解像度**: H3 のネイティブキャンバスは短辺 768px、上限は 768x1344 で、解像度は 32 の倍数に丸められます
4. **長さ**: 長さの入力は、24fps におけるモデルの 17 フレーム/ブロック（17k+5）グリッドにスナップされます
5. **ステップ数は 8 で固定**: この蒸留チェックポイントは 8 ステップで学習されています。スケジューラのステップ数を変更すると品質が低下します

プロンプト作成のリソースについては、[プロンプトガイド](/ja/tutorials/video/minimax/minimax-h3-prompt-guide) を参照してください。

## FastH3 画像から動画

静止画を同期オーディオ付きで動かします。最初と最後のフレームの制御にも対応しています。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_fastvideo_fasth3_i2v.mp4" />

<CardGroup cols={2}>
  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_fastvideo_fasth3_i2v.json">
    JSON をダウンロード、またはテンプレートライブラリで "FastVideo FastH3: Image to Video" を検索
  </Card>
</CardGroup>

**入力素材**

このファイルを対応する `LoadImage` ノードにアップロードするか、自分の画像を使用してください:

<CardGroup cols={2}>
  <Card title="red_line_barrier.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/red_line_barrier.png">
    画像から動画ワークフローのサンプル最初のフレーム
  </Card>
</CardGroup>

### 最初と最後のフレームモード

`MiniMaxH3ImageToVideo` ノードの `first_frame` と/または `last_frame` に画像を接続すると、2 つのキーフレーム間の動きを生成します。どちらも接続しない場合はテキストから動画になります。

### プロンプトのコツ

1. **動きとオーディオを説明する**: 見た目は画像が担うため、プロンプトは動き、カメラ、伴奏オーディオに集中してください
2. **長さ**: 長さの入力は、24fps におけるモデルの 17 フレーム/ブロック（17k+5）グリッドにスナップされます
3. **ステップ数は 8 で固定**: スケジューラは 8 ステップのままにしてください。チェックポイントはそのスケジュールで蒸留されています

## モデルダウンロード

拡散モデルは FastVideo リポジトリから、テキストエンコーダーと VAE はベースの MiniMax H3 モデルと共通です。

<CardGroup cols={2}>
  <Card title="拡散モデル: fastvideo_fasth3_8step_v2_pruned_int8_convrot" icon="download" href="https://huggingface.co/FastVideo/FastVideo-FastH3-Comfy/resolve/main/diffusion_models/fastvideo_fasth3_8step_v2_pruned_int8_convrot.safetensors">
    <code>ComfyUI/models/diffusion\_models/</code> に配置
  </Card>

  <Card title="テキストエンコーダー: qwen3vl_32b_minimax_h3_nvfp4_awq" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors">
    <code>ComfyUI/models/text\_encoders/</code> に配置
  </Card>

  <Card title="VAE: minimax_h3_video_vae_fp16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_video_vae_fp16.safetensors">
    <code>ComfyUI/models/vae/</code> に配置
  </Card>

  <Card title="VAE: minimax_h3_audio_vae_fp32" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_audio_vae_fp32.safetensors">
    <code>ComfyUI/models/vae/</code> に配置
  </Card>
</CardGroup>

### モデルの保存場所

```
ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │   └── fastvideo_fasth3_8step_v2_pruned_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │   └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
│   └── 📂 vae/
│       ├── minimax_h3_video_vae_fp16.safetensors
│       └── minimax_h3_audio_vae_fp32.safetensors
```

## ワークフロー構造のメモ

両方の FastH3 ワークフローは、ベースの H3 構成と以下のノードを共有し、蒸留固有の設定が加わっています:

* **BlockSparseAttention**: Video Sparse Attention（VSA）を `keep_percent` 10、スケジュールの 20% から実行し、品質を保ちながら注意計算のコストを削減します
* **MiniMaxH3SigmaShift**: 蒸留スケジュールに合わせた H3 シグマシフト（動画 10、オーディオ 3）を適用します
* **ComfyMathExpression**: 長さの入力を、24fps の 17k+5 グリッド上の有効なフレーム `length` に変換します
* **サンプラー**: `res_multistep` サンプラー、`simple` スケジューラ、8 ステップ
