> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# MiniMaxH3ImageToVideo - ComfyUI Built-in Node Documentation

> Complete documentation for the MiniMaxH3ImageToVideo node in ComfyUI. Learn its inputs, outputs, parameters and usage.

此节点为使用 MiniMax H3 模型生成视频准备所需的 conditioning 和空 latent。它接受文本提示，并可选择接受视频首帧和/或末帧的图像，将其转换为模型输入。关键帧图像会被调整大小、编码，并附加到视频开头和结尾的 conditioning 中。

## 输入

| 参数     | 描述                                                                             | 数据类型   | 必需 | 范围                           |
| ------ | ------------------------------------------------------------------------------ | ------ | -- | ---------------------------- |
| `clip` | 用于对提示词进行分词并将关键帧图像编码为 conditioning 的 CLIP 模型。                                   | CLIP   | 是  |                              |
| `vae`  | 当提供关键帧图像时，用于将关键帧图像编码到 latent 空间的 VAE 模型。                                       | VAE    | 是  |                              |
| `提示词`  | 描述要生成视频的文本提示。支持多行和动态提示。                                                        | STRING | 是  |                              |
| `宽度`   | 视频宽度（像素，默认值：1344）。                                                             | INT    | 是  | 32 到 MAX\_RESOLUTION (步长 32) |
| `高度`   | 视频高度（像素，默认值：768）。                                                              | INT    | 是  | 32 到 MAX\_RESOLUTION (步长 32) |
| `长度`   | 以 24 fps 计的帧数，向上取整到模型的 17k+5 网格（124 约等于 5 秒；训练范围约为 124-362，更长时长未经测试）（默认值：124）。 | INT    | 是  | 5 到 3600 (步长 17)             |
| `首帧`   | 可选图像，用作视频的第一帧。该图像会被拉伸到整个画布大小，因此不保留其宽高比。仅使用输入批次中的第一张图像。                         | IMAGE  | 否  |                              |
| `末帧`   | 可选图像，用作视频的最后一帧。该图像会被裁剪以覆盖画布，同时保留其宽高比。仅使用输入批次中的第一张图像。                           | IMAGE  | 否  |                              |

当提供了 `first_frame` 和/或 `last_frame` 时，关键帧图像会通过 VAE 编码，并分别附加到第 0 帧和最后一帧的 conditioning 上。如果两者均未提供，则此节点仅根据提示词工作。

## 输出

| 输出名称     | 描述                                                               | 数据类型         |
| -------- | ---------------------------------------------------------------- | ------------ |
| `正向`     | 包含编码后提示词的 conditioning；当提供关键帧图像时，还包含编码后的关键帧和用于 MiniMax H3 模型的帧数。 | CONDITIONING |
| `latent` | 表示待生成视频的空 latent，包含所请求的宽度、高度和帧数。                                 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MiniMaxH3ImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `46efc87bd46f4a86cb6df37c75f960419a2a98b34480e7dc0023c9d87903870b`
