> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanFirstLastFrameToVideo - ComfyUI Built-in Node Documentation

> WanFirstLastFrameToVideo 节点通过将起始帧和结束帧与文本提示组合，为视频生成准备条件。

WanFirstLastFrameToVideo 节点通过将起始帧和结束帧与文本提示组合，为视频生成准备条件。它将帧图像编码到潜在空间中，创建一个掩码来告诉视频模型哪些帧是已知的，并在提供 CLIP 视觉特征时附加这些特征。该节点输出更新后的正向和负向条件，以及一个定义待生成视频大小和长度的空潜在变量。

## 输入

| 参数            | 描述                                                     | 数据类型                 | 必需 | 范围                    |
| ------------- | ------------------------------------------------------ | -------------------- | -- | --------------------- |
| `正向`          | 用于指导视频生成的正向文本条件。                                       | CONDITIONING         | 是  | -                     |
| `负向`          | 用于指导视频生成的负向文本条件。                                       | CONDITIONING         | 是  | -                     |
| `vae`         | 用于将组合后的帧图像编码到潜在空间的 VAE 模型。                             | VAE                  | 是  | -                     |
| `宽度`          | 生成视频的宽度（以像素为单位）（默认值：832，步长：16）。                        | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `高度`          | 生成视频的高度（以像素为单位）（默认值：480，步长：16）。                        | INT                  | 是  | 16 to MAX\_RESOLUTION |
| `长度`          | 视频序列中的帧数（默认值：81，步长：4）。                                 | INT                  | 是  | 1 to MAX\_RESOLUTION  |
| `批量大小`        | 一次生成的视频数量（默认值：1）。                                      | INT                  | 是  | 1 到 4096              |
| `clip 视觉起始图像` | 从起始图像提取的 CLIP 视觉特征。如果同时提供起始和结束 CLIP 视觉输入，则会将它们的特征组合起来。 | CLIP\_VISION\_OUTPUT | 否  | -                     |
| `clip 视觉结束图像` | 从结束图像提取的 CLIP 视觉特征。如果同时提供起始和结束 CLIP 视觉输入，则会将它们的特征组合起来。 | CLIP\_VISION\_OUTPUT | 否  | -                     |
| `起始图像`        | 视频序列的起始帧图像。使用其前 `length` 帧，并将其调整为 `width` × `height`。  | IMAGE                | 否  | -                     |
| `结束图像`        | 视频序列的结束帧图像。使用其最后 `length` 帧，并将其调整为 `width` × `height`。 | IMAGE                | 否  | -                     |

**注意：** 当提供了 `start_image` 或 `end_image` 中的至少一个时，节点会构建一个组合帧序列，其中起始帧和结束帧被填入，其余帧使用中性灰色占位符（0.5）。掩码将已填充区域标记为已知，将占位符区域标记为未知，从而使视频模型能够生成中间的帧。当提供了起始图像时，已知区域还会在图像之外额外扩展 3 帧。相同的编码帧图像和掩码同时附加到 `positive` 和 `negative` 条件上。如果同时提供了两个 CLIP 视觉输入，则会将它们的隐藏状态拼接起来；如果只提供一个，则单独使用该输入。潜在视频长度在时间压缩后由 `length` 计算得出：`((length - 1) // 4) + 1`。

## 输出

| 输出名称     | 描述                                | 数据类型         |
| -------- | --------------------------------- | ------------ |
| `正向`     | 附带了编码帧图像、掩码和（如果提供）CLIP 视觉特征的正向条件。 | CONDITIONING |
| `负向`     | 附带了编码帧图像、掩码和（如果提供）CLIP 视觉特征的负向条件。 | CONDITIONING |
| `latent` | 空潜在张量（全零），其形状适用于给定的批量大小、视频长度和分辨率。 | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanFirstLastFrameToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `0072e441cb80334c3c961d1bbf2d081c78bc38ed1eacca840c577a2d01b36f05`
