Skip to main content
MiniMax H3 비디오의 모션을 텍스트만이 아닌 제어 비디오로 제어하세요. Fun ControlNet Union 패치(alibaba-pai/MiniMax-H3-Fun-Controlnet-Union, Comfy-Org/MiniMax-H3에 포함)는 Canny, Depth, HED, MLSD 또는 Pose 제어 비디오로 H3를 conditioning하는 단일 checkpoint이며, 마스크를 사용한 비디오 inpainting도 실행합니다. fl2varef2va transformer 파일 모두에서 작동합니다. MiniMax H3 Fun ControlNet Union 워크플로 미리보기

Comfy Cloud에서 실행

Comfy Cloud에서 열기

워크플로 다운로드

JSON을 다운로드하거나 템플릿 라이브러리에서 “MiniMax H3 Fun ControlNet Union”을 검색하세요.
입력 자료 이 파일을 해당 비디오 불러오기 노드에 업로드하세요:

dancer_field_pose.mp4

예제 워크플로에서 사용되는 Pose 제어 비디오입니다. 또는 직접 준비한 비디오를 사용해도 됩니다.
이 템플릿은 ComfyUI 0.35.0 이상이 필요합니다. 예제는 Pose 제어 비디오를 사용합니다. 기본 제공 SDPose 서브그래프가 입력 비디오에서 Pose 스켈레톤을 추출하므로, 출력이 댄서의 움직임을 재현합니다. 또한 사전 처리된 제어 비디오를 Apply MiniMax H3 Fun ControlNet 노드의 control_video 입력에 직접 연결할 수도 있습니다.

모델 다운로드

Diffusion 모델: minimax_h3_ref2va_pruned_int8_convrot

ComfyUI/models/diffusion_models/ 폴더에 넣으세요.

ControlNet 패치: minimax_h3_fun_controlnet_union_pruned_int8_convrot

ComfyUI/models/model_patches/ 폴더에 넣으세요.

텍스트 인코더: qwen3vl_32b_minimax_h3_nvfp4_awq

ComfyUI/models/text_encoders/ 폴더에 넣으세요.

VAE: minimax_h3_video_vae_fp16

ComfyUI/models/vae/ 폴더에 넣으세요.

VAE: minimax_h3_audio_vae_fp32

ComfyUI/models/vae/ 폴더에 넣으세요.

LoRA: minimax_h3_ref2v_turbo_4step_v0.1_comfyui_bf16

선택적 Lightning LoRA 터보 모드를 지원합니다. ComfyUI/models/loras/ 폴더에 넣으세요.

체크포인트: sdpose_wholebody_fp16

내장 SDPose 서브그래프에서 사용하는 포즈 추출기입니다. ComfyUI/models/checkpoints/ 폴더에 넣으세요.

탐지기: rt_detr_v4-x-hgnet_fp16

내장 SDPose 서브그래프에서 사용하는 사람 탐지기입니다. ComfyUI/models/diffusion_models/ 폴더에 넣으세요.

모델 저장 위치

프롬프트 팁

  1. 비디오 길이: 대상 비디오는 24fps 기준 17n+5 프레임 그리드에서 5~15초 동안 실행됩니다(124프레임 = 5초). 대상 비디오보다 긴 컨트롤 비디오는 첫 프레임들로 트리밍되고, 더 짧은 비디오는 마지막 프레임이 유지됩니다. 컨트롤 비디오의 길이와 정확히 일치시키려면 예제에서 계산된 batch_size 출력을 MiniMax H3 Reference to Video 노드의 길이 입력에 링크하세요.
  2. 가이드 및 강도: guidance_scale은 1.0으로 유지하세요. 출력이 컨트롤에서 벗어나는 경우에만 패치 strength를 1 이상으로 높이세요.
  3. 비디오 인페인팅: mask 입력에 마스크를 연결하세요. 1로 표시된 영역은 선택적 source_video 입력의 제어에 따라 재생성되며, 프레임의 나머지 부분은 고정된 상태로 유지됩니다.
  4. 터보 모드(선택 사항): Lightning LoRA 체크박스를 활성화하면 4단계 터보 LoRA를 사용하여 훨씬 빠른 생성이 가능하며, 오디오 및 모션 품질은 약간 낮아집니다.
  5. 컨트롤 비디오 준비: ComfyUI에는 각 컨트롤 유형에 대한 기본 제공 전처리 노드가 포함되어 있습니다. 가장자리는 Detect Edges (Canny) 노드를, 깊이 맵은 Depth Anything 3 튜토리얼을 참조하세요.