入力
共通入力
sol-attn 入力
sla 入力
vsa 入力
注記: 現在選択されているメソッドに属するパラメータのみがインターフェースに表示されます。
出力
制約と制限
min_tokensより短いシーケンス、dense_blocksに記載されたブロック、およびstart_percentからend_percentの範囲外のサンプリングステップは、Model Attention Backend ノードで選択された密なモデルアテンションバックエンドにフォールバックします。vsaメソッドが選択されている場合、extra_tokensは無視されます。VSA の重みはスパースパターンに対してトレーニングされているため、メッセージがログに記録されます。vsaメソッドには MiniMax-H3 モデルが必要です。それ以外のモデルではエラーが発生します。モデルにto_gate_compress層がない場合、ファインステージは粗いブランチなしで実行され、警告がログに記録されます。- ブロックインデックスを報告しないモデルでは
dense_blocksは無視されます。これはverboseが有効な場合にログに記録されます。 sink_conditioningは、現在のシーケンス長に一致するレイアウトを報告する MiniMax-H3 モデルにのみ適用されます。
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
0c34876b49a04db0ab265526e2bb5f784e150591aab631713ad2ab420a3327c4