Skip to main content
이 노드는 LTXV-AV 모델에 크로스 모달(오디오-비디오) 가이던스를 적용합니다. 샘플링 중에 각 단계마다 오디오-투-비디오 및 비디오-투-오디오 교차 주의 연결을 비활성화한 상태로 추가 순방향 패스를 한 번 실행한 다음, 결과를 결합된 예측 쪽으로 유도하여 립싱크와 같은 오디오-비주얼 동기화를 강화합니다. modality_scale의 기본 참조값은 3.0이며, 1.0으로 설정하면 추가 패스가 비활성화됩니다. 또한 dual-CFG 가이더 및 STG와 함께 중첩 적용할 수 있습니다.

입력

가이던스는 시그마 값이 start_percentend_percent로 정의된 범위 내에 속하는 샘플링 단계에서만 적용됩니다. 이 범위를 벗어나면 노드는 노이즈 제거된 결과를 변경 없이 반환합니다. modality_scale이 1.0이면 추가 순방향 패스도 완전히 비활성화됩니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 038be607c42e626a8a8f5fe336ee466d0847d43835edb71e20ff38f668069cfb