Skip to main content
Wan22ImageToVideoLatent 根据图像创建视频潜空间表示。它生成具有指定宽度、高度、帧长度和批大小的空白视频潜空间,并可选地将起始图像序列编码到起始帧中。当提供了起始图像时,该节点将其编码到潜空间中,并创建相应的噪声掩码,标记生成过程中哪些区域应被去噪。

输入

注意: 当提供了 start_image 时,图像序列会被放大到目标 widthheight,使用 VAE 编码,并放入潜空间的第一帧。这些帧的噪声掩码设置为 0(保留),而其余帧的掩码值为 1(待去噪)。潜空间始终有 48 个通道,空间维度为 height / 16 × width / 16,时间维度为 ((length - 1) // 4) + 1widthheight 必须能被 16 整除(通过步长 32 强制实现),length 以 4 为步长增加时间维度。

输出

两个字段一起在单个 LATENT 输出中返回。
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 3d05980641eeef2e86df7a845aa8b2bd703882db98fe71adef2746ab34a9d717