Skip to main content
MiniMax H3 Reference to Video는 MiniMax H3 참조-영상 생성에 필요한 텍스트 컨디셔닝과 빈 영상 잠재(latent)를 생성합니다. 프롬프트와 선택적 참조 이미지, 영상, 오디오 클립을 제공하면 노드는 이러한 참조를 모델이 생성 중에 사용할 수 있는 토큰으로 인코딩합니다. 프롬프트는 <Picture i>, <Video k>, <Audio j> 태그로 참조를 지정합니다.

입력

참고:
  • 프롬프트는 각 유형별 1부터 시작하는 태그로 참조 미디어를 지정합니다: 이미지에는 <Picture i>, 비디오에는 <Video k>, 오디오에는 <Audio j>를 사용합니다. 참조는 고정된 순서로 모델에 제공됩니다: 이미지, 그 다음 비디오(각 사운드트랙의 <Audio j> 라벨은 해당 <Video k> 바로 앞에 위치), 그 다음 독립 실행형 오디오입니다.
  • 참조 비디오는 최소 5프레임(24fps에서 약 0.2초)을 포함해야 하며, 그렇지 않으면 노드가 오류를 발생시킵니다. 비디오 프레임은 또한 선택된 length로 제한되고 지원되는 프레임 수로 잘립니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 529e51c5c9c63a94176a15851f40ac42f7bd93e7d7c6ad334ed22aa29d04dfde