> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# HeyGenTalkingPhotoNode - ComfyUI Built-in Node Documentation

> 使用 HeyGen 的 Avatar IV 技术，将人物的静态图像动画化为唇形同步的说话视频。

使用 HeyGen 的 Avatar IV 技术，将人物的静态图像动画化为唇形同步的说话视频。您可以使用 HeyGen 转换为语音的文本脚本驱动动画，或提供您自己的音频供虚拟形象进行唇形同步。

## 输入

### 通用输入

| 参数    | 描述                                  | 数据类型           | 必填 | 范围                                                                          |
| ----- | ----------------------------------- | -------------- | -- | --------------------------------------------------------------------------- |
| `图像`  | 要动画化的人物图像。如果大于 2K，会自动缩小。            | IMAGE          | 是  | -                                                                           |
| `语音`  | 使用文本脚本（HeyGen 文本转语音）或您自己的音频来驱动虚拟形象。 | DYNAMIC\_COMBO | 是  | `"script"`<br />`"audio"`                                                   |
| `分辨率` | 输出视频分辨率（默认：`"1080p"`）。              | COMBO          | 否  | `"720p"`<br />`"1080p"`                                                     |
| `宽高比` | 输出宽高比。`"auto"` 跟随输入图像（默认：`"auto"`）。 | COMBO          | 否  | `"auto"`<br />`"16:9"`<br />`"9:16"`<br />`"1:1"`<br />`"4:5"`<br />`"5:4"` |
| `表现力` | 动画面部和手势的表现力程度（默认：`"low"`）。          | COMBO          | 否  | `"low"`<br />`"medium"`<br />`"high"`                                       |
| `种子`  | 不会发送到 HeyGen；更改它以强制重新运行（默认：42）。     | INT            | 否  | 0 到 2147483647                                                              |

### 脚本输入

当 `speech` 为 `"script"` 时显示。

| 参数                | 描述                                                                  | 数据类型   | 必填 | 范围                 |
| ----------------- | ------------------------------------------------------------------- | ------ | -- | ------------------ |
| `text`            | 虚拟形象要说的文本（最多 5000 个字符）。生成的语音必须至少 1 秒长。（默认：空）                        | STRING | 是  | 1 到 5000 个字符       |
| `voice`           | 脚本的语音（HeyGen 最受欢迎的语音）。                                              | COMBO  | 是  | 提供多个选项             |
| `custom_voice_id` | 可选的 HeyGen 语音 ID。设置后，将覆盖上面选择的语音。可以使用 HeyGen 语音库（2000+）中的任何语音。（默认：空） | STRING | 否  | -                  |
| `voice_speed`     | 语速倍率（默认：1.0）。                                                       | FLOAT  | 否  | 0.5 到 1.5（步长 0.05） |

### 音频输入

当 `speech` 为 `"audio"` 时显示。

| 参数      | 描述                       | 数据类型  | 必填 | 范围       |
| ------- | ------------------------ | ----- | -- | -------- |
| `audio` | 供虚拟形象进行唇形同步的音频，最长 10 分钟。 | AUDIO | 是  | 最长 10 分钟 |

注意：当 `speech` 为 `"script"` 时，必须指定 `text`，并且需要通过 `voice` 选择器（选择除虚拟形象默认语音以外的任何选项）或 `custom_voice_id` 提供语音。当 `speech` 为 `"audio"` 时，则需要提供 `audio`。

## 输出

| 输出名称    | 描述                    | 数据类型  |
| ------- | --------------------- | ----- |
| `video` | 生成的动态说话照片视频，带有唇形同步语音。 | VIDEO |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HeyGenTalkingPhotoNode/zh.md)

***

**Source fingerprint (SHA-256):** `2181066a8c6191cfcaa15ece4f89a16c37e76aa22763d6df4007baa20336f05a`
