在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“MiniMax H3: Multiframe Reference”
参考帧 1:h3_frame_ref_1.png
镜头 1 的身份参考与首帧;也可使用你自己的图像。
参考帧 2:h3_frame_ref_2.png
锚定在 1.5 秒处的关键帧(镜头 2);也可使用你自己的图像。
参考帧 3:h3_frame_ref_3.png
锚定在 3.0 秒处的关键帧(镜头 3);也可使用你自己的图像。
参考帧 4:h3_frame_ref_4.png
锚定在 5.0 秒处的首帧(镜头 4);也可使用你自己的图像。
模型下载
扩散模型:minimax_h3_ref2va_pruned_int8_convrot
放置于
ComfyUI/models/diffusion_models/文本编码器:qwen3vl_32b_minimax_h3_nvfp4_awq
放置于
ComfyUI/models/text_encoders/VAE:minimax_h3_video_vae_fp16
放置于
ComfyUI/models/vae/VAE:minimax_h3_audio_vae_fp32
放置于
ComfyUI/models/vae/LoRA:minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16
为可选的 Lightning LoRA 加速模式提供支持。放置于
ComfyUI/models/loras/模型存储
提示技巧
- 按标签引用:
<Picture 1>是连接到第一个ref_images槽位的图像,<Picture 2>是连接到第二个ref_images槽位的图像,依此类推。在此工作流中,<Picture 1>既用于身份锁定,也用作视频的第一帧。 - 时间轴锚点与引用对照:仅连接到 Add Guide 节点的图像会固定特定帧的构图,但文本编码器看不到它们。如果希望提示词能以
<Picture N>的形式引用这些图像,也请将它们插入额外的ref_images槽位。 - 帧索引:每个 Add Guide 节点都接收以 24fps 帧为单位的
frame_idx;模板使用round(seconds * 24)根据秒数计算该值。负值从视频末尾起算。索引值与引导长度之和必须保持在已生成时长范围内。 - 添加更多关键帧:复制一个引导块(Load Image + Frame Index + Math Expression + Add Guide for MiniMax H3 的组合),并保持
positive输出串联接入 Basic Guider。 - Turbo 模式(可选):启用 Lightning LoRA 复选框,即可使用 4 步 turbo LoRA 大幅加快生成速度,但音频与动作质量会略有下降。
提示词编写指南
模板提示词遵循全参考模式提示编写指南:它会定义每个主体,将每个<Picture N> 映射到某个镜头的首帧或关键帧,并在明确的时间戳处切换镜头。编写自己的多镜头提示词时,请使用相同的结构。该指南已总结在概览页面上。