입력
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
이 노드는 오디오 클립을 분석하여 비디오 생성 모델을 안내할 수 있는 특징 집합으로 변환합니다. 템포와 비트를 추정하고, 멜 스펙트로그램, MFCC, 크로마, 온셋 특징을 추출한 다음, 동기화를 위해 계산된 프레임 레이트와 함께 패키징합니다.
| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 |
|---|---|---|---|---|
audio | 분석 및 인코딩할 오디오 입력입니다. 오디오에 여러 채널이 있는 경우, 특징 추출 전에 채널을 모노로 평균화합니다. | AUDIO | 예 | - |
video_frames | 대상 비디오의 프레임 수입니다. 동기화를 위한 프레임 레이트를 계산하는 데 사용됩니다(기본값: 149). | INT | 예 | Min: 1, Max: 16384 (MAX_RESOLUTION), Step: 4 |
audio_inject_scale | 비디오 모델에 주입될 때 오디오 특징의 스케일입니다(기본값: 1.0). | FLOAT | 예 | Min: 0.0, Max: 10.0, Step: 0.01 |
| 출력 이름 | 설명 | 데이터 타입 |
|---|---|---|
audio_encoder_output | 처리된 오디오 특징, 계산된 프레임 레이트(fps), 오디오 주입 스케일을 포함하는 딕셔너리입니다. 이 출력은 비디오 생성 모델을 컨디셔닝하는 데 사용됩니다. | AUDIO_ENCODER_OUTPUT |
fps_string | 오디오 길이와 비디오 프레임 수를 기반으로 계산된 프레임 레이트(fps)를 설명하는 텍스트 문자열입니다. 이 문자열은 비디오 모델의 프롬프트에 사용하도록 의도되었습니다. 참조 파이프라인과 일치하도록 중국어로 포맷팅됩니다. | STRING |
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018