模型Stable Diffusion 3
SD3
SD3(Stable Diffusion 3)是由Stability AI开发的第三代文本生成图像扩散模型。该模型采用多模态扩散变换器(MMDiT)架构,在文本理解、图像质量与细节还原方面相较前代有所提升,能够更准确地解析复杂提示词并生成高保真图像。SD3支持多种分辨率输出,适用于艺术创作、设计辅助等场景,是Stable Diffusion系列的重要迭代版本。
时间轴 (近 90 天)
6月3日
2023-2024年间,图像生成领域经历了从Stable Diffusion 1.5到SDXL再到SD3的架构跃迁
待验证60%
6月1日
ComfyUI兼容SD1.5、SDXL、SD3、Flux等主流模型
待验证85%
6月1日
sd-scripts支持LoRA、LyCORIS(LoHa、LoKr等)、Textual Inversion、DreamBooth等微调方法,并支持SD 1.5、SDXL和SD3
待验证90%
6月1日
SD3引入了MMDiT(Multi-Modal Diffusion Transformer)架构,用Transformer替代了传统的U-Net骨干网络,并采用三重文本编码器(CLIP ViT-L、OpenCLIP ViT-bigG、T5-XXL)
待验证90%