入力
注記: VAE が提供された場合、ノードは提供されたすべての入力画像から参照用ラテントを生成します。最大3つの画像を一度に処理できます。画像は視覚言語処理のために、アスペクト比を維持したまま 384x384 ピクセルのターゲット領域にスケーリングされ、VAE エンコーディングの場合は 8 で割り切れる寸法(ターゲット領域は 1024x1024 ピクセル)にスケーリングされます。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
5eea53a84045924b44d445244e6149b341188d22573aaaced87bac8a139dac96