> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanHuMoImageToVideo - ComfyUI Built-in Node Documentation

> WanHuImageToVideo 节点通过为视频帧生成潜在表示，将图像转换为视频序列。

WanHuImageToVideo 节点通过为视频帧生成潜在表示，将图像转换为视频序列。它会处理 conditioning 输入，并可结合参考图像和音频嵌入来影响视频生成。该节点输出适合视频合成的修改后 conditioning 数据和潜在表示。

## 输入

| 参数        | 描述                                           | 数据类型               | 是否必需 | 范围                   |
| --------- | -------------------------------------------- | ------------------ | ---- | -------------------- |
| `正面提示词`   | 正向 conditioning 输入，引导视频生成朝向期望内容              | CONDITIONING       | 是    | -                    |
| `负面提示词`   | 负向 conditioning 输入，引导视频生成远离不需要的内容            | CONDITIONING       | 是    | -                    |
| `VAE`     | 用于将参考图像编码到潜在空间的 VAE 模型                       | VAE                | 是    | -                    |
| `宽度`      | 输出视频帧的宽度（以像素为单位）（默认值：832，必须能被 16 整除）         | INT                | 是    | 16 到 MAX\_RESOLUTION |
| `高度`      | 输出视频帧的高度（以像素为单位）（默认值：480，必须能被 16 整除）         | INT                | 是    | 16 到 MAX\_RESOLUTION |
| `长度`      | 生成视频序列中的帧数（默认值：97，必须满足 (length - 1) 能被 4 整除） | INT                | 是    | 1 到 MAX\_RESOLUTION  |
| `批次大小`    | 同时生成的视频序列数量（默认值：1）                           | INT                | 是    | 1 到 4096             |
| `音频编码器输出` | 可选的音频编码数据，可根据音频内容影响视频生成                      | AUDIOENCODEROUTPUT | 否    | -                    |
| `参考图像`    | 用于引导视频生成风格和内容的可选参考图像                         | IMAGE              | 否    | -                    |

**注意：** 当提供参考图像时，它会被编码为潜在表示并附加到正向 conditioning 上，同时一个形状相同的零填充潜在表示会被附加到负向 conditioning 上。当提供音频编码器输出时，音频嵌入会被插值并附加到正向 conditioning 上，同时一个零填充的音频嵌入会被附加到负向 conditioning 上。如果省略可选输入，则参考潜在表示和音频嵌入均使用零填充的占位张量。

## 输出

| 输出名称    | 描述                                                     | 数据类型         |
| ------- | ------------------------------------------------------ | ------------ |
| `正面提示词` | 修改后的正向 conditioning，已包含参考图像和/或音频嵌入                     | CONDITIONING |
| `负面提示词` | 修改后的负向 conditioning，已包含参考图像和/或音频嵌入                     | CONDITIONING |
| `潜空间`   | 视频序列的潜在表示，初始化为零，并根据 `width`、`height` 和 `length` 设置调整大小 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanHuMoImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `db674a4a00729a8715988030083e2858f958cd21de73bbbe4ed6d76f5f539419`
