> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# HunyuanVideo15ImageToVideo - ComfyUI Built-in Node Documentation

> HunyuanVideo15ImageToVideo 节点基于 HunyuanVideo 1.5 模型，为视频生成准备条件（conditioning）和潜空间数据。

HunyuanVideo15ImageToVideo 节点基于 HunyuanVideo 1.5 模型，为视频生成准备条件（conditioning）和潜空间数据。它会为视频序列创建初始潜空间表示，并可选择集成起始图像或 CLIP 视觉输出，以引导生成过程。

## 输入

| 参数         | 描述                                                            | 数据类型                 | 必需 | 范围                              |
| ---------- | ------------------------------------------------------------- | -------------------- | -- | ------------------------------- |
| `正面条件`     | 用于描述视频应包含内容的正向条件提示词。                                          | CONDITIONING         | 是  | -                               |
| `负面条件`     | 用于描述视频应避免内容的负向条件提示词。                                          | CONDITIONING         | 是  | -                               |
| `vae`      | 用于将起始图像编码到潜空间的 VAE（变分自编码器）模型。                                 | VAE                  | 是  | -                               |
| `宽度`       | 输出视频帧的宽度（像素）。必须能被 16 整除。（默认值：848）                             | INT                  | 是  | 16 to MAX\_RESOLUTION, step: 16 |
| `高度`       | 输出视频帧的高度（像素）。必须能被 16 整除。（默认值：480）                             | INT                  | 是  | 16 to MAX\_RESOLUTION, step: 16 |
| `帧数`       | 视频序列中的总帧数。数值从 1 开始以 4 为步长递增（1, 5, 9, 13, ...）。（默认值：33）        | INT                  | 是  | 1 to MAX\_RESOLUTION, step: 4   |
| `批次大小`     | 单个批次中生成的视频序列数量。（默认值：1）                                        | INT                  | 是  | 1 到 4096                        |
| `图像`       | 用于初始化视频生成的可选起始图像。如果提供，该图像将被编码并用于对前几帧进行条件化。仅使用图像的前 `length` 帧。 | IMAGE                | 否  | -                               |
| `CLIP视觉输出` | 可选的 CLIP 视觉嵌入，用于为生成过程提供额外的视觉条件。                               | CLIP\_VISION\_OUTPUT | 否  | -                               |

**注意：** 提供 `start_image` 时，该图像会自动使用双线性插值调整为指定的 `width` 和 `height`。系统会使用图像批次的前 `length` 帧，并且仅对每帧的前 3 个颜色通道进行编码。编码后的图像会作为 `concat_latent_image` 并带有相应的 `concat_mask`，同时添加到 `positive` 和 `negative` 条件中。对于起始图像覆盖的帧，掩码设置为 0.0；对于其余帧，掩码设置为 1.0。提供 `clip_vision_output` 时，它也会同时添加到 `positive` 和 `negative` 条件中。

## 输出

| 输出名称     | 描述                                     | 数据类型         |
| -------- | -------------------------------------- | ------------ |
| `正面条件`   | 修改后的正向条件，现在可能包含编码后的起始图像或 CLIP 视觉输出。    | CONDITIONING |
| `负面条件`   | 修改后的负向条件，现在可能包含编码后的起始图像或 CLIP 视觉输出。    | CONDITIONING |
| `latent` | 一个空的潜空间张量，其维度根据指定的批次大小、视频长度、宽度和高度进行配置。 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/HunyuanVideo15ImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `dbedf7f378ae9613c8f47fe9876a4576c815055b4cdb6bf687b7575fcd7ea80a`
