LTX-2.5 擅长什么
- 同步音频和视频:两种模型层级都会同时生成音频和视频,并原生支持多镜头场景
- 两种模型层级:LTX-2.5 (Pro) 提供最高质量,LTX-2.5 (Fast) 通过蒸馏模型实现更快的生成速度
- 最高 4K 输出:Fast 层级最高可输出 4K 分辨率
- 无需本地 GPU:生成过程在 Lightricks 的服务器上运行,无需下载模型
- 多种生成模式:文生视频、图生视频和首尾帧生视频
示例输出
带同步音频的文生视频生成: 基于单张起始图像的图生视频生成: 首尾帧生视频生成,将两帧画面融合为一个动画序列:LTX-2.5 API 工作流
模板库附带了三个 API 示例工作流:- 文生视频:根据文本提示生成视频
- 图生视频:根据单张起始图像生成视频
- FLF2V:在第一帧和最后一帧图像之间生成视频
LTX-2.5 文生视频
通过 LTX-2.5 API 根据文本提示生成视频,并带有同步音频。在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“LTX-2.5 T2V”
提示技巧
- 模型:选择
LTX-2.5 (Pro)以获得最高质量,或选择LTX-2.5 (Fast)以加快生成速度 - 时长:Pro 支持 2-10 秒,Fast 支持 2-20 秒。时长超过 10 秒需要使用 720p 或 1080p 分辨率,以及 24/25 FPS
- 分辨率与比例:选择分辨率预设,例如
1280x720(横向)或720x1280(纵向);Fast 还提供2560x1440和3840x2160选项 - FPS:Fast 可在 24、25、48 或 50 FPS 之间选择,Pro 可在 24、25 或 50 FPS 之间选择
- 音频:音频生成默认开启;如果只需要静音视频,可以在节点的高级设置中关闭
- 提示词:用一个连贯的段落描述整个场景,包括镜头、动作、角色、相机移动,以及你想要的音频
LTX-2.5 图生视频
通过 LTX-2.5 API 从单张起始图像生成视频,并带有同步音频。在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“LTX-2.5 I2V”
输入图像:space_battle.png
工作流的起始帧,或使用你自己的图像。
提示技巧
- 模型:此工作流默认选择
LTX-2.5 (Fast)以便更快迭代;如需最高质量,可切换到LTX-2.5 (Pro) - 仅单张图像:图像输入只接受一张起始图像
- 提示词:描述接下来会发生什么:从起始图像延续的运动、相机移动和声音。使用“将提供的起始图像作为第一帧”之类的表述有助于稳定生成
- 时长与分辨率:Fast 支持最长 20 秒和最高 4K 分辨率;超过 10 秒的时长需要 720p/1080p 分辨率及 24/25 FPS
LTX-2.5 FLF2V
通过 LTX-2.5 API 在第一帧和最后一帧图像之间生成视频,将两帧融合成一个动画序列。在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON,或在模板库中搜索“LTX-2.5 FLF2V”
第一帧:porsche_car_01.png
视频的第一帧。
最后一帧:porsche_car_02.png
视频的最后一帧,连接到节点的
last_frame 输入。提示技巧
- 帧:工作流将第一张图像连接到
image输入,将第二张图像连接到last_frame输入;模型生成两帧之间的运动 - 保持帧对齐:使用宽高比相同的图像,以获得平滑的插值
- 模型:此工作流默认选择
LTX-2.5 (Pro);如需加快生成速度,可切换到LTX-2.5 (Fast) - 提示词:描述帧之间的过渡,以及你想要的音频(对白、音效、音乐)