> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# ComfyUI MiniMax H3 テキストから動画・画像から動画・参照から動画のワークフロー

> ComfyUI で MiniMax H3 のテキストから動画(T2V)、画像から動画(I2V)、参照から動画(R2V)ワークフローを実行し、ガイドのアンカー固定や latent ノイズマスクなどの高度なテクニックを紹介します。

このページでは、ComfyUI の 3 つの基本 MiniMax H3 テンプレートワークフローと、ネイティブ H3 ノード上に構築された高度なテクニックについて説明します。モデルの機能、プロンプトの作成、高速化については、[MiniMax H3 概要](/ja/tutorials/video/minimax/minimax-h3) を参照してください。

## MiniMax H3 テキストからビデオ (T2V)

テキストプロンプトから、ネイティブのステレオオーディオ付きビデオを生成します。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_minimax_h3_t2v.mp4" />

<CardGroup cols={2}>
  <Card title="Comfy Cloudで実行" icon="cloud" href="https://cloud.comfy.org/?template=video_minimax_h3_t2v&utm_source=docs&utm_medium=referral&utm_campaign=minimax-h3">
    Comfy Cloudで開く
  </Card>

  <Card title="ワークフローのダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_minimax_h3_t2v.json">
    JSONをダウンロードするか、テンプレートライブラリで「MiniMax H3 T2V」を検索してください
  </Card>
</CardGroup>

### モデルのダウンロード

<CardGroup cols={2}>
  <Card title="Diffusion Model: minimax_h3_fl2va_pruned_int8_convrot" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors">
    <code>ComfyUI/models/diffusion\_models/</code> に配置します
  </Card>

  <Card title="Text Encoder: qwen3vl_32b_minimax_h3_nvfp4_awq" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors">
    <code>ComfyUI/models/text\_encoders/</code> に配置します
  </Card>

  <Card title="VAE: minimax_h3_video_vae_fp16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_video_vae_fp16.safetensors">
    <code>ComfyUI/models/vae/</code> に配置します
  </Card>

  <Card title="VAE: minimax_h3_audio_vae_fp32" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_audio_vae_fp32.safetensors">
    <code>ComfyUI/models/vae/</code> に配置します
  </Card>

  <Card title="LoRA: minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16" icon="download" href="https://huggingface.co/lightx2v/Minimax-h3-Turbo/resolve/main/minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors">
    ワークフローのモデルスキャンに必須です。オプションのLightning LoRAターボモードで使用します。<code>ComfyUI/models/loras/</code> に配置します
  </Card>
</CardGroup>

### モデルの保存先

```
ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │   └── minimax_h3_fl2va_pruned_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │   └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
│   ├── 📂 vae/
│   │   ├── minimax_h3_video_vae_fp16.safetensors
│   │   └── minimax_h3_audio_vae_fp32.safetensors
│   ├── 📂 loras/
│   │   └── minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors
│   └── 📂 embeddings/
│       └── minimaxh3_art_is_explosion.safetensors
```

### プロンプト作成のヒント

1. **シーン全体を説明する**：最初にシーン全体（場所、キャラクター、何が起きているか）を説明し、次に時間単位のショットに分割します
2. **ショット、カメラ、オーディオ**：ショット、カメラワーク、それに伴うオーディオ（台詞、効果音、音楽）を1つのプロンプトブロック内で説明します
3. **解像度**：H3のネイティブキャンバスは短辺768pxで、16:9では1344x768になります。解像度は32の倍数に丸められます
4. **再生時間**：再生時間の入力は、24fpsにおけるモデルの17フレーム/ブロック（17k+5）グリッドにスナップされます
5. **先頭/末尾フレーム**：`MiniMaxH3ImageToVideo` ノードの `first_frame` や `last_frame` に画像を接続すると、このワークフローを先頭/末尾フレーム指定の画像から動画への変換にできます
6. **ターボモード（オプション）**：デフォルトでは20ステップで生成します。動きの品質を高めるには、ステップ数を増やします（例: 25）。MiniMax H3ノードで `turbo_mode` を有効にすると、同梱のLightning LoRA（`minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16`）が8ステップで使用され、オーディオと動きの品質はやや低下しますが、生成が大幅に高速化されます

公式のベースモード向け[プロンプト作成ガイド](https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/docs/VIDEO_PROMPT_WRITING_GUIDE_base_en.md)の要約は、[概要ページ](/ja/tutorials/video/minimax/minimax-h3-prompt-guide)にあります。

## MiniMax H3 画像からビデオ（I2V）

入力画像からビデオを生成します。先頭フレームと最終フレームは、オプションのキーフレームとして指定できます。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_minimax_h3_i2v.mp4" />

<CardGroup cols={2}>
  <Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=video_minimax_h3_i2v&utm_source=docs&utm_medium=referral&utm_campaign=minimax-h3">
    Comfy Cloud で開く
  </Card>

  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_minimax_h3_i2v.json">
    JSONをダウンロードするか、テンプレートライブラリで「MiniMax H3 I2V」を検索してください
  </Card>
</CardGroup>

<CardGroup cols={1}>
  <Card title="入力画像: transparent_rgb_gaming_mouse.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/transparent_rgb_gaming_mouse.png">
    デフォルトの入力画像をダウンロードするか、ご自身の画像を使用してください。
  </Card>
</CardGroup>

### モデルのダウンロード

<CardGroup cols={2}>
  <Card title="Diffusion Model: minimax_h3_fl2va_pruned_int8_convrot" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors">
    <code>ComfyUI/models/diffusion\_models/</code> に配置します
  </Card>

  <Card title="Text Encoder: qwen3vl_32b_minimax_h3_nvfp4_awq" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors">
    <code>ComfyUI/models/text\_encoders/</code> に配置します
  </Card>

  <Card title="VAE: minimax_h3_video_vae_fp16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_video_vae_fp16.safetensors">
    <code>ComfyUI/models/vae/</code> に配置します
  </Card>

  <Card title="VAE: minimax_h3_audio_vae_fp32" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_audio_vae_fp32.safetensors">
    <code>ComfyUI/models/vae/</code> に配置します
  </Card>
</CardGroup>

<CardGroup cols={1}>
  <Card title="Turbo LoRA: minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16" icon="download" href="https://huggingface.co/lightx2v/Minimax-h3-Turbo/blob/main/minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors">
    <code>ComfyUI/models/loras/</code> に配置します。<code>turbo\_mode</code> を有効にした場合に使用します。
  </Card>
</CardGroup>

### モデルの保存場所

```
ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │   └── minimax_h3_fl2va_pruned_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │   └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
│   ├── 📂 loras/
│   │   └── minimax_h3_fl2v_turbo_8step_v1.0_comfyui_bf16.safetensors
│   ├── 📂 vae/
│   │   ├── minimax_h3_video_vae_fp16.safetensors
│   │   └── minimax_h3_audio_vae_fp32.safetensors
│   └── 📂 embeddings/
│       └── minimaxh3_art_is_explosion.safetensors
```

### プロンプトのヒント

1. **キーフレーム**: `first_frame` と `last_frame` の入力はオプションです。モデルはこれらの間の動きを生成します
2. **プロンプト**: ショット、動き、および付随するオーディオ（会話、SFX、音楽）を 1 つのブロックで記述します
3. **解像度**: H3 のネイティブキャンバスは短辺 768px で、16:9 では 1344x768 になります。解像度は 32 の倍数に丸められます
4. **再生時間**: 再生時間の入力は、24fps におけるモデルの 17 フレーム/ブロック（17k+5）グリッドにスナップします
5. **Turbo モード**: MiniMax H3 ノードで `turbo_mode` を有効にすると、Turbo LoRA に切り替わり、20 ステップではなく `turbo_steps`（デフォルト 8）で生成されます。`turbo_model_strength` は LoRA の強度を制御します（デフォルト 1.0）。

公式のベースモード向け [プロンプト作成ガイド](https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/docs/VIDEO_PROMPT_WRITING_GUIDE_base_en.md) は、[概要ページ](/ja/tutorials/video/minimax/minimax-h3-prompt-guide) にまとめられています。

## MiniMax H3 リファレンスからビデオ (R2V)

参照画像・ビデオ・オーディオを自由に組み合わせて、キャラクター、スタイル、モーション、カメラワーク、声を固定したビデオを生成します。

<video controls className="w-full aspect-video" src="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/output/video_minimax_h3_r2v.mp4" />

<CardGroup cols={2}>
  <Card title="Comfy Cloud で実行" icon="cloud" href="https://cloud.comfy.org/?template=video_minimax_h3_r2v&utm_source=docs&utm_medium=referral&utm_campaign=minimax-h3">
    Comfy Cloud で開く
  </Card>

  <Card title="ワークフローをダウンロード" icon="download" href="https://github.com/Comfy-Org/workflow_templates/blob/main/templates/video_minimax_h3_r2v.json">
    JSON をダウンロードするか、テンプレートライブラリで「MiniMax H3 R2V」を検索してください
  </Card>
</CardGroup>

<CardGroup cols={2}>
  <Card title="参照画像: red_superboy_on_city_roof.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/red_superboy_on_city_roof.png">
    ワークフローのキャラクター参照です。独自の画像を使用することもできます。
  </Card>

  <Card title="参照画像: mecha_dragon_lightning.png" icon="image" href="https://raw.githubusercontent.com/Comfy-Org/workflow_templates/main/input/mecha_dragon_lightning.png">
    ワークフローのスタイル・被写体参照です。独自の画像を使用することもできます。
  </Card>
</CardGroup>

### モデルのダウンロード

<CardGroup cols={2}>
  <Card title="Diffusion Model: minimax_h3_ref2va_pruned_int8_convrot" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/diffusion_models/minimax_h3_ref2va_pruned_int8_convrot.safetensors">
    <code>ComfyUI/models/diffusion\_models/</code> に配置してください。
  </Card>

  <Card title="Text Encoder: qwen3vl_32b_minimax_h3_nvfp4_awq" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors">
    <code>ComfyUI/models/text\_encoders/</code> に配置してください。
  </Card>

  <Card title="VAE: minimax_h3_video_vae_fp16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_video_vae_fp16.safetensors">
    <code>ComfyUI/models/vae/</code> に配置してください。
  </Card>

  <Card title="VAE: minimax_h3_audio_vae_fp32" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/vae/minimax_h3_audio_vae_fp32.safetensors">
    <code>ComfyUI/models/vae/</code> に配置してください。
  </Card>

  <Card title="LoRA: minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16" icon="download" href="https://huggingface.co/Comfy-Org/MiniMax-H3/blob/main/loras/minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors">
    ワークフローのモデルスキャンに必要で、オプションの Lightning LoRA ターボモードを有効にします。<code>ComfyUI/models/loras/</code> に配置してください。
  </Card>
</CardGroup>

### モデルの保存先

```
ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │   └── minimax_h3_ref2va_pruned_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │   └── qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors
│   ├── 📂 vae/
│   │   ├── minimax_h3_video_vae_fp16.safetensors
│   │   └── minimax_h3_audio_vae_fp32.safetensors
│   ├── 📂 loras/
│   │   └── minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16.safetensors
│   └── 📂 embeddings/
│       └── minimaxh3_art_is_explosion.safetensors
```

### プロンプトのヒント

1. **タグで参照を指定**: 接続した順番どおりにタグで各入力を参照します。例: `<Picture 1>`、`<Video 1>`、`<Audio 1>`
2. **各参照に役割を割り当てる**: どの参照がショットのどの部分(アイデンティティ、スタイル、モーション、カメラ、声)を担うかを明示します。役割を明確に指定するほうがはるかに良い結果になります
3. **制限**: 参照画像は最大 9 枚、参照ビデオは最大 3 本(それぞれ独自のサウンドトラックを持てます)、独立した参照オーディオは最大 3 本
4. **ref\_image\_size**: `match` は速度のために参照を生成解像度に合わせて縮小します。`max` は最大 2048px の短辺を維持し、速度と引き換えにアイデンティティの忠実度を高めます
5. **注意**: R2V は `ref2va` Diffusion Model を使用します。これは T2V および I2V ワークフローで使用される `fl2va` モデルとは別の重みセットです
6. **ターボモード(オプション)**: ワークフローはデフォルトで 20 ステップで生成します。モーション品質を上げたい場合はステップ数を増やします(例: 25)。**Lightning LoRA** チェックボックスを有効にすると、4 ステップのターボ LoRA(`minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16`)で生成が大幅に高速化されます(オーディオとモーションの品質は若干低下します)。

公式のフルリファレンスモード向け [プロンプト作成ガイド](https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/docs/VIDEO_PROMPT_WRITING_GUIDE_ref_en.md) は、[概要ページ](/ja/tutorials/video/minimax/minimax-h3-prompt-guide) にまとめられています。

## ネイティブノードによる高度なワークフロー

ネイティブのMiniMax H3ノードは、最近のComfyUIアップデートで追加された2つの追加ワークフローをサポートしています。これらを使用するには、ComfyUIを最新バージョンにアップデートしてください。

### ガイドを任意のフレームにアンカーする (#15439)

[Comfy-Org/ComfyUI#15439](https://github.com/Comfy-Org/ComfyUI/pull/15439) で `MiniMaxH3AddGuide` ノードが追加されました。それ以前は、キーフレームはビデオの最初と最後のフレームにのみアンカーできました。このノードはその制限をなくし、連続した時間軸上でガイドを任意のフレームにアンカーできるようにします。

MiniMax H3ノードの `positive` 出力と潜在出力を `MiniMaxH3AddGuide` に接続し、少なくとも1つのガイド入力を指定します。

* **image**: 静止画像またはクリップを指定します。複数フレームのバッチはクリップとしてアンカーされ、モデルの有効なクリップ長である5、22、39...フレーム（17k+5）にクロップされます。5フレーム未満のバッチでは最初の画像のみが使用されます
* **audio**: 同じフレームインデックスにアンカーされるサウンドトラックで、ビデオの残りの再生時間に合わせてクロップされます
* **frame\_idx**: アンカーするフレームを指定します。負の値はビデオの末尾から数えます

画像を指定する場合はビデオVAEを `vae` に接続し、オーディオを指定する場合はオーディオVAEを `audio_vae` に接続します。複数の `MiniMaxH3AddGuide` ノードをチェーンすると、複数のフレームにガイドをアンカーできます。

たとえば、既存のビデオの最初の22フレームとそのオーディオを、フレーム0にアンカーする `MiniMaxH3AddGuide` に入力すると、モデルは両方のストリームの続きを生成します。また、124フレームのビデオのフレーム60に静止画像を配置して、ビデオがそのフレームを通過するように強制することもできます。

先頭/末尾フレームへのアンカーは従来と同じ座標を生成するため、既存のワークフローは変更なしでそのまま動作します。

[マルチフレーム参照テンプレート](/ja/tutorials/video/minimax/minimax-h3-multiframe) は、このノードをベースにしたすぐに使えるワークフローです。

### 潜在ノイズマスクによるインペイントと拡張 (#15375)

[Comfy-Org/ComfyUI#15375](https://github.com/Comfy-Org/ComfyUI/pull/15375) で、ビデオとオーディオの潜在表現の両方をカバーするトークン単位のノイズマスクがMiniMax H3に追加されました。これにより、ビデオの一部だけを再生成し、残りを固定したままにすることができます。

通常どおり、サンプラーの `denoise_mask` 入力にマスクを接続します。値 `0` は対応する潜在領域を保持し、値 `1` はその領域を再生成します。ビデオマスクはモデルの2x2潜在パッチグリッドにスナップし、オーディオマスクは潜在フレーム全体にスナップします。局所的なインペイント、オブジェクトの削除、または既存のコンテンツを安定させたままのクリップ拡張に使用できます。
