输入
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25cDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
MiniMax Music3 Text Encode 使用 MiniMax Music3 CLIP 模型,将文本描述和歌词转换为用于音乐生成的声学条件序列。
| 参数 | 描述 | 数据类型 | 必需 | 范围 |
|---|---|---|---|---|
clip | MiniMax Music3 CLIP 模型,用于文本编码和条件序列生成。 | CLIP | 是 | - |
caption | 描述要生成音乐的文字。支持多行文本和动态提示词。 | STRING | 是 | - |
歌词 | 用于生成音乐的歌词文本。支持多行文本和动态提示词。 | STRING | 是 | - |
种子 | 生成过程的可复现随机种子。默认值:0。 | INT | 是 | 0 到 18446744073709551615 (0xffffffffffffffff) |
最大时长 | 最大时长(秒);模型可以提前结束歌曲。默认值:120.0。 | FLOAT | 是 | 0.04 至模型的最大音频时长(MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND),步长 0.04 |
cfg 缩放 | 无分类器引导(CFG)比例。默认值:模型常量 CFG_SCALE。高级参数。 | FLOAT | 是 | 0.0 到 100.0, step 0.1 (keeps 2 decimal places) |
top_k | 用于声学 token 选择的 top-k 采样值。默认值:模型常量 CFG_TOP_K。高级参数。 | INT | 是 | 1 至模型词表大小(C0_VOCAB_SIZE) |
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
conditioning | 生成的声学条件序列,用于指导后续音乐生成。 | CONDITIONING |
秒 | 条件序列的实际时长(秒)。 | FLOAT |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25c