width, height, length, batch_size에 맞는 빈 비디오 latent를 생성하며, 선택적으로 시작 이미지를 인코딩하여 positive 및 negative conditioning을 업데이트함으로써 생성되는 비디오의 초기 프레임을 안내할 수 있습니다.
입력
참고:
start_image가 제공되면 지정된 width 및 height에 맞게 이중선형 보간을 사용하여 자동으로 크기가 조정됩니다. 이미지 배치의 처음 length 프레임만 인코딩에 사용되며, 추가 프레임은 무시됩니다. 이미지 배치의 프레임 수가 length보다 적으면 해당 프레임만 사용됩니다. 이미지의 RGB 채널만 인코딩됩니다. 그런 다음 인코딩된 latent가 positive 및 negative 컨디셔닝 모두에 주입되어 비디오의 초기 모습을 안내하고, 노이즈가 없는 인코딩된 프레임이 모델 출력 latent의 노이즈가 있는 시작 부분을 대체합니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
7212f0ea912578d3b72dddf1333a20054a881e3f22c2b8abd9645fc21e75a08b