Skip to main content
LTXVSeparateAVLatent 节点用于将组合的音频-视频潜在表示拆分为两个独立的潜在表示:一个包含视频数据,另一个包含音频数据。此节点适用于任何音频-视频模型,例如 LTXV 或 MiniMax H3。samples 张量沿其第一个维度进行拆分,第一个元素成为视频潜在表示,第二个元素成为音频潜在表示;如果存在噪声掩码(noise_mask),则按相同方式拆分。

输入

注意: 输入潜在表示的 samples 张量预计在第一个维度(批次维度)上至少包含两个元素。第一个元素用于视频潜在表示,第二个元素用于音频潜在表示。如果存在 noise_mask,则按相同方式拆分。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 22ed38bbc1b5716cee380c35c50455810f79c273f51bbe6a535c9ae33192afe6