入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25cDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
MiniMax Music3 Text Encode は、MiniMax Music3 CLIP モデルを使用して、テキストキャプションと歌詞を音楽生成用の音響条件付けシーケンスに変換します。
| パラメータ | 説明 | データ型 | 必須 | 範囲 |
|---|---|---|---|---|
clip | テキストエンコードと条件付けシーケンス生成に使用される MiniMax Music3 CLIP モデル。 | CLIP | はい | - |
caption | 生成する音楽を説明するテキスト。複数行テキストと動的プロンプトに対応しています。 | STRING | はい | - |
歌詞 | 音楽生成に使用される歌詞テキスト。複数行テキストと動的プロンプトに対応しています。 | STRING | はい | - |
seed | 生成プロセス用の再現可能な乱数シード。デフォルト: 0。 | INT | はい | 0 から 18446744073709551615 (0xffffffffffffffff) |
max_duration | 最大時間(秒)。モデルは曲を早く終了することができます。デフォルト: 120.0。 | FLOAT | はい | 0.04 からモデルの最大オーディオ時間(MAX_AUDIO_FRAMES / AUDIO_FRAMES_PER_SECOND)まで、ステップ 0.04 |
cfg_scale | クラシファイアフリーガイダンススケール。デフォルト: モデル定数 CFG_SCALE。高度なパラメータ。 | FLOAT | はい | 0.0 から 100.0、ステップ 0.1(小数第2位を保持) |
top_k | 音響トークン選択に使用される Top-k サンプリング値。デフォルト: モデル定数 CFG_TOP_K。高度なパラメータ。 | INT | はい | 1 からモデルの語彙サイズ(C0_VOCAB_SIZE)まで |
| 出力名 | 説明 | データ型 |
|---|---|---|
conditioning | 生成された音響条件付けシーケンス。後続の音楽生成をガイドするために使用されます。 | CONDITIONING |
秒 | 条件付けシーケンスの実際の時間(秒)。 | FLOAT |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
c3fbfd189d0358ebf081dd4f9c32be9231a9d0b97fd767401ea4b7955224c25c