Skip to main content
LTXVImgToVideo는 입력 이미지를 비디오 생성 모델용 비디오 잠재 표현으로 변환합니다. 요청된 너비와 높이로 이미지를 리사이즈하고, VAE로 인코딩한 뒤, 인코딩된 프레임을 0으로 채워진 비디오 크기의 잠재 표현 시작 부분에 배치합니다. strength 제어는 비디오 생성 중 원본 이미지 콘텐츠가 얼마나 보존되고 얼마나 수정되는지를 결정합니다.

입력

참고: widthheight는 32픽셀 단위로 변경되고, length는 8프레임 단위로 변경되며, 이는 비디오 잠재 압축(공간 차원에서 32배, 시간 차원에서 8배)과 일치합니다. 비디오 잠재 표현은 ((length - 1) // 8) + 1개의 프레임을 포함합니다. 입력 이미지는 중앙 크롭을 사용하는 양선형 스케일링을 통해 width x height로 리사이즈되며, 인코딩에는 처음 세 채널만 사용됩니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 4ebc7f80b4d9ac3329e3349c7048885de22b827b5bdd102976687afd7e07a16b