概述
此节点为使用因果强制(Causal Forcing)或自强制(Self-Forcing)的自回归(AR)视频模型准备图像到视频生成设置。它使用 VAE 将起始图像编码到潜空间,并将其存储在模型的 transformer 选项中,以便视频采样过程可以在去噪前初始化 KV 缓存。它使用与文本到视频相同的模型检查点,因此无需单独的图像到视频架构。输入
注意:起始图像在编码前会调整到指定的
width 和 height。潜时间维度计算为 ((length - 1) // 4) + 1,潜空间维度为 height / 8 和 width / 8。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
984834951b9d5a22aef51c85a5019fd8ba58cdb2d6fff235371ed29f316896d8