> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-custom-nodes-sdk-v2-frontend.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# GeminiVideoOmni - ComfyUI Built-in Node Documentation

> 使用 Google 的 Gemini Omni Flash 模型，根据文本提示生成带有音频的视频。

使用 Google 的 Gemini Omni Flash 模型，根据文本提示生成带有音频的视频。可选择提供参考图像和/或参考视频来引导或编辑结果。直接在提示中描述所需的时长（3-10 秒）和宽高比（16:9 或 9:16）。

## 输入

### 通用输入

| 参数      | 描述                                          | 数据类型           | 是否必填 | 范围             |
| ------- | ------------------------------------------- | -------------- | ---- | -------------- |
| `model` | 用于生成视频的 Gemini 视频模型。                        | DYNAMIC\_COMBO | 是    | "Omni Flash"   |
| `seed`  | `seed` 控制节点是否应重新运行；无论种子如何，结果都是不确定的（默认值：42）。 | INT            | 是    | 0 到 2147483647 |

### Omni Flash 输入

| 参数            | 描述                                                                                                       | 数据类型   | 是否必填 | 范围            |
| ------------- | -------------------------------------------------------------------------------------------------------- | ------ | ---- | ------------- |
| `prompt`      | 描述要生成的视频。直接在提示中指定时长和宽高比，例如“一个 6 秒、16:9 的片段”。时长可为 3-10 秒；宽高比必须为 16:9（横向）或 9:16（纵向）。输出为 720p、24 FPS，并带有音频。 | STRING | 是    | 去除空白后至少 1 个字符 |
| `temperature` | 控制随机性。较低的值更聚焦/确定，较高的值变化更多（默认值：1.0）。                                                                      | FLOAT  | 否    | 0.0 到 2.0     |
| `top_p`       | 核采样：从累积概率达到 `top_p` 的最小标记集合中进行采样（默认值：0.95）。                                                              | FLOAT  | 否    | 0.0 到 1.0     |

### 参考输入

| 参数       | 描述                                                                 | 数据类型  | 是否必填 | 范围                  |
| -------- | ------------------------------------------------------------------ | ----- | ---- | ------------------- |
| `images` | 可增长插槽：连接一个或多个参考图像（`image_1`...`image_14`）以引导或动画化视频。总共最多 14 张图像。    | IMAGE | 否    | 0 到 14 张图像          |
| `videos` | 可增长插槽：连接一个或多个参考视频（`video_1`...`video_3`）以引导或编辑。最多 3 个视频，每个最长 10 秒。 | VIDEO | 否    | 0 到 3 个视频，每个最长 10 秒 |

注意事项：

* 如果图像输入包含多个帧，则每一帧都计入 14 张图像的上限。
* 当提供参考图像或视频时，编码后的媒体总大小必须保持在约 90 MB 以下；否则节点会报错。
* 当未提供参考图像或视频时，节点仅根据文本提示生成视频。

## 输出

| Output Name | 描述                       | 数据类型   |
| ----------- | ------------------------ | ------ |
| `VIDEO`     | 来自 Gemini 模型的、带有音频的生成视频。 | VIDEO  |
| `STRING`    | 模型返回的任何文本回复，例如推理或解释。     | STRING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/GeminiVideoOmni/zh.md)

***

**Source fingerprint (SHA-256):** `648844868affb68298d2eac8ac20095bfe378d32e721396781de330ef6a6d69f`
