> ## Documentation Index
> Fetch the complete documentation index at: https://docs.comfy.org/llms.txt
> Use this file to discover all available pages before exploring further.

# LTXVModalityGuidance - ComfyUI Built-in Node Documentation

> 此节点对 LTXV-AV 模型应用跨模态（音频-视频）引导。

此节点对 LTXV-AV 模型应用跨模态（音频-视频）引导。在采样过程中，它每一步会额外执行一次前向传播，并禁用音频到视频和视频到音频的交叉注意力连接，然后将结果推向耦合预测。这增强了音视频同步性，例如唇形同步。`modality_scale` 的参考默认值为 3.0；将其设置为 1.0 可禁用额外的前向传播。

## 输入

| 参数               | 描述                                           | 数据类型  | 必需 | 范围                         |
| ---------------- | -------------------------------------------- | ----- | -- | -------------------------- |
| `model`          | 将应用模态引导的基础模型。它会在内部克隆，使原始模型保持不变。              | MODEL | 是  | -                          |
| `modality_scale` | 音频-视频耦合引导的强度。默认值为 3.0。设置为 1.0 可禁用额外的前向传播。    | FLOAT | 是  | 1.0 到 100.0 (default: 3.0) |
| `start_percent`  | 采样过程中模态引导开始的时间点，以 0.0 到 1.0 的百分比表示。默认值为 0.0。 | FLOAT | 是  | 0.0 到 1.0 (default: 0.0)   |
| `end_percent`    | 采样过程中模态引导结束的时间点，以 0.0 到 1.0 的百分比表示。默认值为 1.0。 | FLOAT | 是  | 0.0 到 1.0 (default: 1.0)   |

模态引导仅应用于 sigma 值落在 `start_percent` 和 `end_percent` 所定义范围内的采样步骤。在此范围之外，节点会原样返回去噪结果。`modality_scale` 为 1.0 时也会完全禁用额外的前向传播。

## 输出

| 输出名称    | 描述                                            | 数据类型  |
| ------- | --------------------------------------------- | ----- |
| `model` | 带有附加 post-CFG 引导函数的克隆模型。此修改后的模型会在采样过程中应用模态引导。 | MODEL |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/LTXVModalityGuidance/zh.md)

***

**Source fingerprint (SHA-256):** `038be607c42e626a8a8f5fe336ee466d0847d43835edb71e20ff38f668069cfb`
