> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# MiniMaxH3ImageToVideo - ComfyUI Built-in Node Documentation

> 此节点用于准备使用 MiniMax H3 模型生成视频所需的条件输入（conditioning）和空潜在变量（latent）。

此节点用于准备使用 MiniMax H3 模型生成视频所需的条件输入（conditioning）和空潜在变量（latent）。它接受一个文本提示，以及可选的视频首帧和/或尾帧图像，并将它们转换为模型输入。关键帧图像会被调整大小、编码，并添加到视频开始和结束时的条件中。

## 输入

| 参数     | 描述                                                                    | 数据类型   | 是否必需 | 范围                              |
| ------ | --------------------------------------------------------------------- | ------ | ---- | ------------------------------- |
| `clip` | 用于对提示进行分词并将关键帧图像编码为条件的 CLIP 模型。                                       | CLIP   | 是    |                                 |
| `vae`  | 当提供关键帧图像时，用于将关键帧图像编码到潜在空间的 VAE 模型。                                    | VAE    | 是    |                                 |
| `提示词`  | 描述要生成的视频的文本提示。支持多行和动态提示。                                              | STRING | 是    |                                 |
| `宽度`   | 视频的宽度（像素），默认值：1344。                                                   | INT    | 是    | 32 to MAX\_RESOLUTION (step 32) |
| `高度`   | 视频的高度（像素），默认值：768。                                                    | INT    | 是    | 32 to MAX\_RESOLUTION (step 32) |
| `长度`   | 24 帧/秒下的帧数，向上取整到模型的 17k+5 网格（124 ≈ 5 秒；训练范围为约 124-362，更长未测试），默认值：124。 | INT    | 是    | 5 到 3600 (step 17)              |
| `首帧`   | 可选图像，用作视频的第一帧。它会被拉伸到整个画布大小，因此不保留宽高比。仅使用输入批次中的第一张图像。                   | IMAGE  | 否    |                                 |
| `末帧`   | 可选图像，用作视频的最后一帧。它会被裁剪以覆盖画布，同时保留宽高比。仅使用输入批次中的第一张图像。                     | IMAGE  | 否    |                                 |

当提供了 `first_frame` 和/或 `last_frame` 时，关键帧图像会通过 VAE 编码，并分别附加到第 0 帧和最后一帧的条件中。如果两者都未提供，则节点仅根据提示工作。请求的 `length` 会被向上取整到最近的有效帧数（17k + 5），因此实际帧数可能略高于请求值。

## 输出

| 输出名称     | 描述                                                    | 数据类型         |
| -------- | ----------------------------------------------------- | ------------ |
| `正向`     | 包含编码后的提示文本，以及当提供关键帧图像时，包含编码后的关键帧和 MiniMax H3 模型的帧数条件。 | CONDITIONING |
| `latent` | 表示待生成内容的空音频-视频潜在变量，具有请求的宽度、高度和帧数。                     | LATENT       |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MiniMaxH3ImageToVideo/zh.md)

***

**Source fingerprint (SHA-256):** `d1bdf3f8c66ef20ff11c35203d2c266a88dcf8cc00c65dbb0aea2b1dd16befd6`
