Skip to main content
TextEncodeZImageOmni 节点将文本提示与最多三张可选参考图像一起编码为图像生成模型的条件格式。提示文本会通过 CLIP 模型进行分词和编码,每个已连接的图像可选地由视觉编码器和/或 VAE 处理,从而将视觉参考嵌入到文本旁边。此节点标记为实验性。

输入

注意: 此节点最多接受三张图像(image1image2image3)。image_encodervae 输入仅在至少提供一张图像时使用;当两者都连接时,每张图像都会同时经过两者处理。当 auto_resize_images 为 True 且连接了 vae 时,图像会在编码前调整大小,使总像素面积接近 1024x1024。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): b40a3150f536b6f37e2b53e6d9992fcb4fd32dceb540c0a76773a7ba1af9a7b8