输入
注意:
seconds 值会四舍五入到最近的音频帧,并限制在至少 1 帧、最多 MAX_AUDIO_FRAMES 帧范围内,因此实际的潜变量长度可能与输入的精确值略有差异。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4bDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
此节点为 MiniMax Music3 模型创建一个空(零填充)音频潜变量。
| 参数 | 描述 | 数据类型 | 必需 | 范围 |
|---|---|---|---|---|
seconds | 音频潜变量的持续时间(以秒为单位)(默认值:120.0)。该值会被转换为音频帧,并限制在模型支持的持续时间范围内。 | FLOAT | 是 | 0.04 to (MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND), step 0.04 |
batch_size | 每个批次生成的音频潜变量数量(默认值:1)。 | INT | 是 | 1 到 4096 |
seconds 值会四舍五入到最近的音频帧,并限制在至少 1 帧、最多 MAX_AUDIO_FRAMES 帧范围内,因此实际的潜变量长度可能与输入的精确值略有差异。
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
LATENT | 形状为 (batch_size, 128, latent_length) 的零填充音频潜变量张量。包含将样本标记为音频数据并带有时间下采样比率 512 的元数据。 | LATENT |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
77e6a69702a837c958c2954bba061c979152f034bc7774a5b6c97ea8d57bda4b