Skip to main content
通过将参考帧锚定在输出时间线上的特定位置,生成视频续写与多镜头场景。该工作流将 Reference to Video 节点与链式 Add Guide 节点结合使用:每个 Add Guide 会把一张静态图像(以及可选的音频)固定到一个帧索引上,从而使视频在那一刻精确经过该构图。 MiniMax H3 Multiframe Reference 工作流预览

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON,或在模板库中搜索“MiniMax H3: Multiframe Reference”

参考帧 1:h3_frame_ref_1.png

镜头 1 的身份参考与首帧;也可使用你自己的图像。

参考帧 2:h3_frame_ref_2.png

锚定在 1.5 秒处的关键帧(镜头 2);也可使用你自己的图像。

参考帧 3:h3_frame_ref_3.png

锚定在 3.0 秒处的关键帧(镜头 3);也可使用你自己的图像。

参考帧 4:h3_frame_ref_4.png

锚定在 5.0 秒处的首帧(镜头 4);也可使用你自己的图像。

模型下载

扩散模型:minimax_h3_ref2va_pruned_int8_convrot

放置于 ComfyUI/models/diffusion_models/

文本编码器:qwen3vl_32b_minimax_h3_nvfp4_awq

放置于 ComfyUI/models/text_encoders/

VAE:minimax_h3_video_vae_fp16

放置于 ComfyUI/models/vae/

VAE:minimax_h3_audio_vae_fp32

放置于 ComfyUI/models/vae/

LoRA:minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16

为可选的 Lightning LoRA 加速模式提供支持。放置于 ComfyUI/models/loras/

模型存储

提示技巧

  1. 按标签引用<Picture 1> 是连接到第一个 ref_images 槽位的图像,<Picture 2> 是连接到第二个 ref_images 槽位的图像,依此类推。在此工作流中,<Picture 1> 既用于身份锁定,也用作视频的第一帧。
  2. 时间轴锚点与引用对照:仅连接到 Add Guide 节点的图像会固定特定帧的构图,但文本编码器看不到它们。如果希望提示词能以 <Picture N> 的形式引用这些图像,也请将它们插入额外的 ref_images 槽位。
  3. 帧索引:每个 Add Guide 节点都接收以 24fps 帧为单位的 frame_idx;模板使用 round(seconds * 24) 根据秒数计算该值。负值从视频末尾起算。索引值与引导长度之和必须保持在已生成时长范围内。
  4. 添加更多关键帧:复制一个引导块(Load Image + Frame Index + Math Expression + Add Guide for MiniMax H3 的组合),并保持 positive 输出串联接入 Basic Guider。
  5. Turbo 模式(可选):启用 Lightning LoRA 复选框,即可使用 4 步 turbo LoRA 大幅加快生成速度,但音频与动作质量会略有下降。

提示词编写指南

模板提示词遵循全参考模式提示编写指南:它会定义每个主体,将每个 <Picture N> 映射到某个镜头的首帧或关键帧,并在明确的时间戳处切换镜头。编写自己的多镜头提示词时,请使用相同的结构。该指南已总结在概览页面上。