SDXL(Stable Diffusion XL)是由Stability AI发布的大规模文本到图像生成模型,是Stable Diffusion系列的升级版本。采用双文本编码器架构,具有更大的模型参数规模,能够生成更高分辨率、细节更丰富的图像,并对复杂提示词具有更强的语义理解与表达能力,广泛应用于AI艺术创作、设计辅助等领域。
2023-2024年间,图像生成领域经历了从Stable Diffusion 1.5到SDXL再到SD3的架构跃迁
SDXL采用了双CLIP编码器(OpenCLIP ViT-bigG和OpenAI CLIP ViT-L)的设计
SD1.5使用768维条件向量,SDXL使用1024维条件向量
ComfyUI兼容SD1.5、SDXL、SD3、Flux等主流模型
sd-scripts支持LoRA、LyCORIS(LoHa、LoKr等)、Textual Inversion、DreamBooth等微调方法,并支持SD 1.5、SDXL和SD3
SDXL(Stable Diffusion XL)是Stability AI推出的高分辨率图像生成模型,其完整管线包含Base模型和Refiner模型两个阶段
SD 1.5系列模型约需4-6G显存,SDXL系列通常需要8-12G显存