Skip to main content
MiniMax H3 是 MiniMax 的通用全模态生成模型,可通过 MiniMax H3 API 节点在 ComfyUI 中使用。API 工作流在 MiniMax 的服务器上执行生成,因此无需下载模型或本地 GPU,生成的视频每秒都会计入您的 Comfy API 账户。 MiniMax H3 生成视频时带有原生立体声音频:人声、音效和音乐在单次前向传播中一同建模,而不是事后叠加。输出最高可达 2K 分辨率,每个片段时长 5-15 秒。
使用 API 节点需要保证你已经正常登录,并在受许可的网络环境下使用,请参考API 节点总览部分文档来了解使用 API 节点的具体使用要求。
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在 ComfyUI 的工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新开发版(nightly)。
  2. 启动时有些节点导入失败。

MiniMax H3 API 工作流

模板库附带三个 API 示例工作流:
  • 文生视频:根据文本提示生成视频
  • 首尾帧视频:在第一帧和最后一帧图像之间生成视频
  • 参考生视频:根据参考图像、视频和音频生成视频

MiniMax H3 文生视频

通过 MiniMax H3 API 根据文本提示生成视频,并带有原生立体声音频。

在 Comfy Cloud 中运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “MiniMax H3 T2V”

提示技巧

  1. 提示词:在一个提示词块中描述整个场景以及伴随的音频(对白、音效、音乐)
  2. 时长:时长输入支持 5-15 秒;工作流附带快速 5 秒预览
  3. 分辨率和比例:API 以 2K 渲染;请选择宽高比预设,例如 16:99:161:1
  4. 水印:AIGC 水印默认关闭;如有需要,可在节点的高级设置中启用

MiniMax H3 首尾帧视频

通过 MiniMax H3 API,在第一帧和可选的最后一帧图像之间生成视频。输出的宽高比遵循输入图像。

在 Comfy Cloud 中运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “MiniMax H3 FLF2V”

首帧:angel-warrior-demon-battle-start.png

该工作流的首帧,或使用您自己的图像。

尾帧:angel-warrior-demon-battle-end.png

该工作流的尾帧,或使用您自己的图像。

提示技巧

  1. first_frame 输入为必填项,last_frame 为可选项。模型会生成两者之间的运动。
  2. 宽高比:输出遵循输入图像,因此请保持两个帧具有相同的宽高比。
  3. 图像约束:每个帧的宽度和高度都必须在 256 到 5760 像素之间,宽高比在 2:5 到 5:2 之间。
  4. 提示词:描述帧之间的转场,以及您想要的音频(对白、音效、音乐)。

MiniMax H3 参考生视频

通过 MiniMax H3 API,根据参考图像、视频和音频生成视频。 MiniMax H3 参考生视频工作流预览

在 Comfy Cloud 中运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索 “MiniMax H3 R2V”

参考图像:9panel_storyboard_golden_hour_clay_court.png

该工作流的分镜参考,或使用您自己的图像。

提示技巧

  1. 按标签引用:在提示词中按顺序引用每个输入,例如 Image 1Video 1Audio 1
  2. 限制:最多 9 张参考图像、3 个参考视频和 3 个参考音频片段。每个视频或音频片段必须为 2-15 秒;参考视频和参考音频的总时长分别以 15 秒为上限。
  3. 音频需要视觉锚点:如果没有至少一个参考图像或视频,则无法使用参考音频。
  4. 视频要求:参考视频必须为 23.976-60 FPS。
  5. 提示词:为每个参考分配一个角色(身份、风格、运动、声音),并描述目标镜头;明确的分配往往效果会好得多。