Skip to main content
LTXVImgToVideo は、入力画像をビデオ生成モデル用のビデオ潜在表現に変換します。画像を指定された幅と高さにリサイズし、VAE でエンコードして、エンコードされたフレームを、ゼロで満たされたビデオサイズの潜在表現の先頭に配置します。strength コントロールは、ビデオ生成中に元の画像コンテンツがどの程度保持されるか、または変更されるかを決定します。

入力

注: widthheight は 32 ピクセル単位で変化し、length は 8 フレーム単位で変化します。これはビデオ潜在表現の圧縮(空間次元で 32 倍、時間次元で 8 倍)に対応しています。ビデオ潜在表現には ((length - 1) // 8) + 1 フレームが含まれます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 4ebc7f80b4d9ac3329e3349c7048885de22b827b5bdd102976687afd7e07a16b