Skip to main content
LTXV Reference Audio는 참조 오디오 클립에서 화자의 음성 정체성을 생성된 오디오로 전이합니다. 참조 오디오를 컨디셔닝에 인코딩하고, 선택적으로 아이덴티티 가이던스로 모델을 패치합니다. 이는 각 단계마다 참조 없이 추가 순방향 패스를 실행하여 화자 정체성 효과를 증폭합니다.

입력

참고: 아이덴티티 가이던스는 identity_guidance_scale이 0보다 크고 현재 샘플링 단계가 start_percentend_percent로 정의된 범위 내에 있을 때만 적용됩니다. 두 값이 다르면 참조 오디오는 오디오 VAE의 샘플 레이트로 리샘플링됩니다. 참고: start_percentend_percent는 고급 매개변수이며, 인터페이스에서 고급 옵션이 활성화된 경우에만 표시됩니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): ae15c5838656324667d099614b325b863341f05afda43054658999574522dd49