输入
说明
latent和guiding_latent都必须是 5D 视频 latent,形状为 (batch, channels, frames, height, width)。- 引导必须适配在目标 latent 内部:引导的帧数加上
latent_idx不得超过目标 latent 的末尾。允许使用负的latent_idx值,这会将引导放置在 latent 开始之前。 - 引导的空间尺寸必须在高度和宽度两个轴上都以整数整除目标的空间尺寸。
- 高度比率和宽度比率必须相同(正方形比率)。非正方形比率会引发错误,因为扩张和 RoPE 放置对两个轴使用单一降采样因子。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
19542500484dbc57fdbeeab8ba05bc2978246b3be5decc413825f616cab46f73