fl2va 및 ref2va transformer 파일 모두에서 작동합니다.
Comfy Cloud에서 실행
Comfy Cloud에서 열기
워크플로 다운로드
JSON을 다운로드하거나 템플릿 라이브러리에서 “MiniMax H3 Fun ControlNet Union”을 검색하세요.
비디오 불러오기 노드에 업로드하세요:
dancer_field_pose.mp4
예제 워크플로에서 사용되는 Pose 제어 비디오입니다. 또는 직접 준비한 비디오를 사용해도 됩니다.
Apply MiniMax H3 Fun ControlNet 노드의 control_video 입력에 직접 연결할 수도 있습니다.
모델 다운로드
Diffusion 모델: minimax_h3_ref2va_pruned_int8_convrot
ComfyUI/models/diffusion_models/ 폴더에 넣으세요.ControlNet 패치: minimax_h3_fun_controlnet_union_pruned_int8_convrot
ComfyUI/models/model_patches/ 폴더에 넣으세요.텍스트 인코더: qwen3vl_32b_minimax_h3_nvfp4_awq
ComfyUI/models/text_encoders/ 폴더에 넣으세요.VAE: minimax_h3_video_vae_fp16
ComfyUI/models/vae/ 폴더에 넣으세요.VAE: minimax_h3_audio_vae_fp32
ComfyUI/models/vae/ 폴더에 넣으세요.LoRA: minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16
선택적 Lightning LoRA 터보 모드를 지원합니다.
ComfyUI/models/loras/ 폴더에 넣으세요.체크포인트: sdpose_wholebody_fp16
내장 SDPose 서브그래프에서 사용하는 포즈 추출기입니다.
ComfyUI/models/checkpoints/ 폴더에 넣으세요.탐지기: rt_detr_v4-x-hgnet_fp16
내장 SDPose 서브그래프에서 사용하는 사람 탐지기입니다.
ComfyUI/models/diffusion_models/ 폴더에 넣으세요.모델 저장 위치
프롬프트 팁
- 비디오 길이: 대상 비디오는 24fps 기준 17n+5 프레임 그리드에서 5~15초 동안 실행됩니다(124프레임 = 5초). 대상 비디오보다 긴 컨트롤 비디오는 첫 프레임들로 트리밍되고, 더 짧은 비디오는 마지막 프레임이 유지됩니다. 컨트롤 비디오의 길이와 정확히 일치시키려면 예제에서 계산된
batch_size출력을MiniMax H3 Reference to Video노드의 길이 입력에 링크하세요. - 가이드 및 강도:
guidance_scale은 1.0으로 유지하세요. 출력이 컨트롤에서 벗어나는 경우에만 패치strength를 1 이상으로 높이세요. - 비디오 인페인팅:
mask입력에 마스크를 연결하세요.1로 표시된 영역은 선택적source_video입력의 제어에 따라 재생성되며, 프레임의 나머지 부분은 고정된 상태로 유지됩니다. - 터보 모드(선택 사항): Lightning LoRA 체크박스를 활성화하면 4단계 터보 LoRA를 사용하여 훨씬 빠른 생성이 가능하며, 오디오 및 모션 품질은 약간 낮아집니다.
- 컨트롤 비디오 준비: ComfyUI에는 각 컨트롤 유형에 대한 기본 제공 전처리 노드가 포함되어 있습니다. 가장자리는 Detect Edges (Canny) 노드를, 깊이 맵은 Depth Anything 3 튜토리얼을 참조하세요.