Skip to main content
Grok Imagine Video 1.5 合作伙伴节点支持从单个图像输入生成带有原生音频的高质量视频。该节点由 xAI 最新的 Grok 模型驱动,可生成带有同步音频的逼真运动,并支持高达 1080p 的分辨率。 该节点通过其 model 参数支持两种模型变体:
  • grok-imagine-video:上一代模型,支持可选图像输入
  • grok-imagine-video-1.5:最新模型,始终需要输入图像,并支持 1080p 输出
两种变体均会生成原生音频:音效、环境音和对话在同一次处理中合成,无需单独的音频 pipeline。视频时长范围为 1 到 15 秒

Grok Imagine Video 1.5 擅长什么

  • 图生视频生成:可从单张输入图像生成高质量视频
  • 原生音频:音效、环境声和对话在同一次生成中合成,无需单独的音频 pipeline
  • 逼真的运动:运动与已生成音频保持同步
  • 最高 1080p 输出:1.5 模型支持 1080p 分辨率
  • 灵活时长:视频时长 1 至 15 秒
使用 API 节点需要保证你已经正常登录,并在受许可的网络环境下使用,请参考API 节点总览部分文档来了解使用 API 节点的具体使用要求。
请确保你的 ComfyUI 已经更新。本指南里的工作流可以在工作流模板中找到。如果找不到,可能是 ComfyUI 没有更新。如果加载工作流时有节点缺失,可能原因有:
  1. 你用的不是最新版(每夜版)。
  2. 启动时有些节点导入失败。

Grok Imagine Video 1.5:图像转视频

在 Comfy Cloud 上运行

在 Comfy Cloud 中打开

下载工作流

下载 JSON 或在模板库中搜索“Grok Imagine Video 1.5”

下载示例输入图像

获取此工作流的示例输入图像。

工作流总览

此工作流使用三个节点:
  • LoadImage:提供起始图像帧
  • GrokVideoNode:配置了 grok-imagine-video-1.5 模型的核心节点
  • SaveVideo:保存已生成的视频及其原生音频

运行步骤

  1. 上传起始图像:使用 LoadImage 节点加载参考图像
  2. 输入提示词:在 GrokVideoNode 节点中描述运动、氛围和场景动态
  3. 选择模型:确保已选择 grok-imagine-video-1.5
  4. 设置分辨率:选择输出分辨率(推荐 720p
  5. 设置时长:以秒为单位选择视频长度
  6. 设置种子:控制节点是否重新运行;无论种子如何,输出均不可复现
  7. 点击队列:按 Ctrl+Enter 生成

输出

生成的视频包含与运动同步的原生音频,并通过 SaveVideo 节点自动保存。

提示

  • 使用高质量的输入图像以获得最佳效果
  • 提示词在同时描述视觉场景运动动态时效果最佳
  • 如需不同结果,请尝试更改种子值