입력
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
bb7120c91ce5d779147cb8553d6f96fa160d87468d4d87550fb6dd4ec89b1557Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
Empty Ace Step 1.5 Latent Audio 노드는 오디오 생성 워크플로를 위해 비어 있는(무음) 오디오 latent 텐서를 생성합니다. 요청된 길이로부터 시간 길이가 계산되는 64채널 latent를 구성하고, 다운스트림 오디오 노드에서 사용할 수 있도록 오디오 데이터로 태그를 지정합니다.
| 매개변수 | 설명 | 데이터 타입 | 필수 | 범위 |
|---|---|---|---|---|
seconds | 생성할 오디오의 길이(초)입니다(기본값: 120.0). latent 길이는 seconds * 48000 / 1920으로 계산되며, 가장 가까운 정수로 반올림됩니다. | FLOAT | 예 | 1.0 - 1000.0 (단계: 0.01) |
batch_size | 배치에 포함된 latent 이미지의 수입니다(기본값: 1). | INT | 예 | 1 - 4096 |
| 출력 이름 | 설명 | 데이터 타입 |
|---|---|---|
LATENT | 무음 오디오를 나타내는 비어 있는 latent 텐서입니다. 텐서의 형상은 [batch_size, 64, length]이며, 여기서 length는 seconds에서 파생됩니다. 출력에는 “audio” 유형 식별자와 1764의 downscale_ratio_temporal 값도 포함되며, 이는 오디오 처리에서 시간적 다운스케일링에 사용됩니다. | LATENT |
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
bb7120c91ce5d779147cb8553d6f96fa160d87468d4d87550fb6dd4ec89b1557