> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# LTXVReferenceAudio - ComfyUI Built-in Node Documentation

> LTXV 参考音频功能可将参考音频片段中的说话人身份特征迁移到生成的音频中。

LTXV 参考音频功能可将参考音频片段中的说话人身份特征迁移到生成的音频中。该节点会将参考音频编码到 conditioning 中，并可选地使用身份引导对模型进行补丁处理，即在每一步额外执行一次不包含参考音频的前向传播，以增强说话人身份特征的效果。

## 输入

| 参数                        | 描述                                                                         | 数据类型         | 必填 | 范围          |
| ------------------------- | -------------------------------------------------------------------------- | ------------ | -- | ----------- |
| `model`                   | 待使用身份引导进行补丁处理的模型。                                                          | MODEL        | 是  | -           |
| `positive`                | 正向 conditioning 输入。                                                        | CONDITIONING | 是  | -           |
| `negative`                | 负向 conditioning 输入。                                                        | CONDITIONING | 是  | -           |
| `reference_audio`         | 参考音频片段，用于迁移其说话人身份特征。建议时长约 5 秒（训练时长）。过短或过长的片段可能会降低身份迁移效果。                   | AUDIO        | 是  | -           |
| `audio_vae`               | 用于编码的 LTXV 音频 VAE。                                                         | VAE          | 是  | -           |
| `identity_guidance_scale` | 身份引导的强度。每一步会额外执行一次不包含参考音频的前向传播，以增强说话人身份特征。设为 0 可禁用该功能（不执行额外前向传播）。（默认值：3.0） | FLOAT        | 是  | 0.0 - 100.0 |
| `start_percent`           | 身份引导生效的 sigma 范围的起始位置。（默认值：0.0）                                            | FLOAT        | 是  | 0.0 - 1.0   |
| `end_percent`             | 身份引导生效的 sigma 范围的结束位置。（默认值：1.0）                                            | FLOAT        | 是  | 0.0 - 1.0   |

注意：仅当 `identity_guidance_scale` 大于 0 且当前采样步骤处于 `start_percent` 与 `end_percent` 定义的范围内时，才会应用身份引导。如果参考音频的采样率与音频 VAE 的采样率不同，参考音频会被重新采样。

## 输出

| 输出名称       | 描述                              | 数据类型         |
| ---------- | ------------------------------- | ------------ |
| `model`    | 已使用身份引导函数进行补丁处理的模型。             | MODEL        |
| `positive` | 正向 conditioning，现已包含编码后的参考音频数据。 | CONDITIONING |
| `negative` | 负向 conditioning，现已包含编码后的参考音频数据。 | CONDITIONING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/LTXVReferenceAudio/zh.md)

***

**Source fingerprint (SHA-256):** `ae15c5838656324667d099614b325b863341f05afda43054658999574522dd49`
