Skip to main content
为 VOID 视频细化过程的第二遍生成时间相关的噪声。它接收 Pass 1 输出的视频,并沿着光流向量扭曲高斯噪声,生成与视频内容一致运动的噪声。此扭曲噪声用作 Pass 2 的起始潜在变量,从而改善最终输出的时间一致性。

输入

关于 length 参数的说明: length 值会自动向下取整到能产生偶数 latent_t 维度的最近有效值。这是 CogVideoX-Fun-V1.5 模型的 patch_size_t=2 约束所要求的。发生取整时会记录一条警告。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): f46b0a73b09a5d2d0bc25676f9571563c6bb8bad8d835e7564ac092c72136107