입력
제약 사항
- latent는 일반 텐서를 포함해야 합니다. 연결된 오디오-비디오 latent는 허용되지 않으며, 먼저 Separate AV Latent 노드로 분리해야 합니다.
- 4D latent(오디오)와 5D latent(비디오)만 지원됩니다. 그 외의 형상은 오류를 발생시킵니다.
- 생성되는 노이즈 마스크는 입력 텐서와 동일한 장치를 사용하여 0으로 생성됩니다. 비디오 latent의 경우 마스크 형상은 (batch, 1, frames, 1, 1)이고, 오디오 latent의 경우 형상은 (batch, 1, frames, 1)입니다.
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
d5d228687f0a124644323c0448dcce53ed6eb2224d3f44d1756079b2a71539ca