Skip to main content
정지된 초상화를 음성 오디오로 구동되는 말하는 비디오로 애니메이션화합니다. sync.so의 sync-3 모델을 사용합니다. 출력 길이는 오디오 길이와 일치하며, 비용은 출력 길이에 비례합니다.

입력

참고: speaker_xspeaker_y 매개변수는 speaker_selection"coordinates"로 설정된 경우에만 사용됩니다. auto_downscale이 활성화되면 화자 좌표가 축소된 이미지 크기에 맞게 자동으로 조정됩니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 21f722cdcc5ff017949887ed2252854feebb9b913034dc6a6c3ce196ad089468