Comfy Cloud에서 실행
Comfy Cloud에서 열기
워크플로 다운로드
JSON을 다운로드하거나 템플릿 라이브러리에서 “MiniMax H3: Multiframe Reference”를 검색하세요.
프레임 레퍼런스 1: h3_frame_ref_1.png
샷 1의 아이덴티티 레퍼런스이자 첫 프레임입니다. 또는 자체 이미지를 사용해도 됩니다.
프레임 레퍼런스 2: h3_frame_ref_2.png
1.5초 지점(샷 2)에 고정된 키프레임입니다. 또는 자체 이미지를 사용해도 됩니다.
프레임 레퍼런스 3: h3_frame_ref_3.png
3.0초 지점(샷 3)에 고정된 키프레임입니다. 또는 자체 이미지를 사용해도 됩니다.
프레임 레퍼런스 4: h3_frame_ref_4.png
5.0초 지점(샷 4)에 고정된 첫 프레임입니다. 또는 자체 이미지를 사용해도 됩니다.
모델 다운로드
Diffusion Model: minimax_h3_ref2va_pruned_int8_convrot
ComfyUI/models/diffusion_models/ 폴더에 넣으세요.Text Encoder: qwen3vl_32b_minimax_h3_nvfp4_awq
ComfyUI/models/text_encoders/ 폴더에 넣으세요.VAE: minimax_h3_video_vae_fp16
ComfyUI/models/vae/ 폴더에 넣으세요.VAE: minimax_h3_audio_vae_fp32
ComfyUI/models/vae/ 폴더에 넣으세요.LoRA: minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16
선택적인 Lightning LoRA 터보 모드를 지원합니다.
ComfyUI/models/loras/ 폴더에 넣으세요.모델 저장 위치
프롬프트 팁
- 태그로 참조하기:
<Picture 1>은 첫 번째ref_images슬롯에 연결된 이미지이고,<Picture 2>는 두 번째ref_images슬롯에 연결된 이미지입니다. 이 워크플로에서<Picture 1>은 정체성 고정(identity lock)이자 비디오의 첫 프레임입니다. - 타임라인 앵커와 참조 이미지의 차이: Add Guide 노드에만 연결된 이미지는 특정 프레임에서 구성을 고정하지만 텍스트 인코더에는 보이지 않습니다. 프롬프트에서 해당 이미지를
<Picture N>으로 참조해야 한다면 추가ref_images슬롯에도 연결하세요. - 프레임 인덱스: 각 Add Guide는 24fps 기준 프레임 단위의
frame_idx를 입력받습니다. 템플릿은round(seconds * 24)로 초를 변환해 프레임 인덱스를 계산합니다. 네거티브 값은 비디오의 끝에서부터 계산됩니다. 인덱스와 가이드 길이의 합이 생성된 재생 시간 안에 있어야 합니다. - 키프레임 더 추가하기: Load Image + Frame Index + Math Expression + Add Guide for MiniMax H3로 구성된 가이드 블록 하나를 복사하고,
positive출력이 Basic Guider로 직렬 연결되도록 체인을 유지하세요. - 터보 모드(선택 사항): Lightning LoRA 체크박스를 활성화하면 4-step 터보 LoRA를 사용해 훨씬 빠르게 생성할 수 있습니다. 단, 오디오와 모션 품질은 약간 낮아집니다.
프롬프트 작성 가이드
템플릿 프롬프트는 전체 참조 모드 프롬프트 가이드를 따릅니다. 즉, 각 피사체를 정의하고, 각<Picture N>을 샷의 첫 프레임 또는 키프레임에 매핑한 다음 명시적 타임스탬프에서 샷 사이를 전환합니다. 자체 멀티샷 프롬프트를 작성할 때도 동일한 구조를 사용하세요. 이 가이드의 요약은 개요 페이지에 있습니다.