Skip to main content
TextEncodeZImageOmniは、テキストプロンプトと、最大3つのオプション参照画像を組み合わせて、画像生成モデル用のコンディショニング形式にエンコードします。プロンプトはCLIPモデルでトークン化およびエンコードされ、接続された各画像は、オプションでビジョンエンコーダーやVAEによって処理され、視覚的な参照がテキストと一緒に埋め込まれます。このノードは実験的としてマークされています。

入力

注記: このノードは最大3つの画像(image1image2image3)を受け入れます。image_encodervae の入力は、少なくとも1つの画像が提供された場合にのみ使用されます。両方が接続されている場合、各画像は両方によって処理されます。auto_resize_images が True で vae が接続されている場合、画像はエンコード前に総ピクセル面積が1024x1024に近くなるようにリサイズされます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): b40a3150f536b6f37e2b53e6d9992fcb4fd32dceb540c0a76773a7ba1af9a7b8