width, height, length, batch_size로부터 빈 latent 비디오를 생성하며, 참조 이미지가 제공되면 VAE로 인코딩하고 시간 차원 시각적 가이던스로 컨디셔닝에 추가합니다.
입력
참고:
images가 제공되면 지정된 width와 height에 맞게 자동으로 업스케일되며, 처음 length개의 이미지만 처리에 사용됩니다. 각 이미지는 vae로 인코딩되어 시간 차원을 따라 연결되며, 각 이미지의 RGB 채널만 사용됩니다. images가 제공되지 않으면 세 가지 컨디셔닝 출력 모두 입력 컨디셔닝에서 변경 없이 반환됩니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
a1853382f6e564f66262b69dd7b06cc58e26b93386a460a98e6fcc2ff6acf12b