model 参数支持两种模型变体:
grok-imagine-video:上一代模型,支持可选图像输入grok-imagine-video-1.5:最新模型,始终需要输入图像,并支持 1080p 输出
Grok Imagine Video 1.5 擅长什么
- 图生视频生成:可从单张输入图像生成高质量视频
- 原生音频:音效、环境声和对话在同一次生成中合成,无需单独的音频 pipeline
- 逼真的运动:运动与已生成音频保持同步
- 最高 1080p 输出:1.5 模型支持 1080p 分辨率
- 灵活时长:视频时长 1 至 15 秒
Grok Imagine Video 1.5:图像转视频
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON 或在模板库中搜索“Grok Imagine Video 1.5”
下载示例输入图像
获取此工作流的示例输入图像。
工作流总览
此工作流使用三个节点:- LoadImage:提供起始图像帧
- GrokVideoNode:配置了
grok-imagine-video-1.5模型的核心节点 - SaveVideo:保存已生成的视频及其原生音频
运行步骤
- 上传起始图像:使用 LoadImage 节点加载参考图像
- 输入提示词:在 GrokVideoNode 节点中描述运动、氛围和场景动态
- 选择模型:确保已选择
grok-imagine-video-1.5 - 设置分辨率:选择输出分辨率(推荐
720p) - 设置时长:以秒为单位选择视频长度
- 设置种子:控制节点是否重新运行;无论种子如何,输出均不可复现
- 点击队列:按
Ctrl+Enter生成
输出
生成的视频包含与运动同步的原生音频,并通过 SaveVideo 节点自动保存。提示
- 使用高质量的输入图像以获得最佳效果
- 提示词在同时描述视觉场景和运动动态时效果最佳
- 如需不同结果,请尝试更改种子值