Skip to main content
이 노드는 LTXV-AV 모델에 크로스 모달(오디오-비디오) 가이던스를 적용합니다. 샘플링 중에 오디오-비디오 및 비디오-오디오 크로스 어텐션 연결을 비활성화한 상태로 단계마다 추가 순방향 패스를 한 번 실행하고, 그 결과를 결합된 예측 쪽으로 끌어당깁니다. 이는 립싱크와 같은 오디오-비주얼 동기화를 강화합니다. modality_scale의 참조 기본값은 3.0이며, 1.0으로 설정하면 추가 패스가 비활성화됩니다.

Inputs

가이던스는 sigma 값이 start_percentend_percent로 정의된 범위 내에 있는 샘플링 단계에만 적용됩니다. 이 범위를 벗어나면 노드는 노이즈 제거 결과를 변경하지 않고 반환합니다. modality_scale이 1.0이면 추가 순방향 패스도 완전히 비활성화됩니다.

Outputs

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 038be607c42e626a8a8f5fe336ee466d0847d43835edb71e20ff38f668069cfb