Skip to main content
使用 Google 的 Gemini 模型生成文本响应。提供一个文本提示,并可选择提供一个或多个图像、音频剪辑、视频或文件作为多模态上下文。

输入

通用输入

Gemini 3.7 Flash 输入

model 设置为 "Gemini 3.7 Flash" 时,显示以下输入。

Gemini 3.5 Flash 输入

model 设置为 "Gemini 3.5 Flash" 时,显示以下输入。

Gemini 3.1 Pro 输入

model 设置为 "Gemini 3.1 Pro" 时,显示以下输入。

Gemini 3.1 Flash-Lite 输入

model 设置为 "Gemini 3.1 Flash-Lite" 时,显示以下输入。

媒体和文件输入

以下输入由所有四个模型共享,并与模型特定输入一起显示。 注意: 当附加媒体(图像、音频或视频)时,节点会将前 10 个媒体项目上传到 ComfyAPI 存储,并以 URL 形式传递;此 URL 配额由所有媒体类型共享,并按顺序消耗(先视频,再音频,最后图像)。其余媒体将以内联 base64 数据编码,最大组合内联负载为 18 MB。如果内联负载超过 18 MB,节点将报错。prompt 参数必须至少包含一个非空白字符。将 seed 设置为 0 则请求随机种子。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 00e0f614303fa723eb787ad763e0b0c6322f89abf43d93b697357527b2fae49c