SD3
SD3(Stable Diffusion 3)是由Stability AI开发的第三代文本生成图像扩散模型。该模型采用多模态扩散变换器(MMDiT)架构,在文本理解、图像质量与细节还原方面相较前代有所提升,能够更准确地解析复杂提示词并生成高保真图像。SD3支持多种分辨率输出,适用于艺术创作、设计辅助等场景,是Stable Diffusion系列的重要迭代版本。
时间轴 (近 90 天)
CFG=4–4.5 是许多 Flux、SD3 系列模型的推荐起点区间,而 SDXL 类模型常用 5–8
FLUX、SD3等模型通过引入文本编码器和更精细的训练数据改善了文字生成能力
Stable Diffusion 1.x使用4通道潜空间,SD3/FLUX等新一代模型升级至16通道
人类心理测评中常用SD3(Short Dark Triad)等标准量表测量暗黑三角特质
shift 值 2.8 遵循 SD3/RAE 的规则 √(32·32·32/4096) 计算,对应 FLUX.2 使用的 32 通道潜空间
全部知识事实 (8)
sd-scripts支持LoRA、LyCORIS(LoHa、LoKr等)、Textual Inversion、DreamBooth等微调方法,并支持SD 1.5、SDXL和SD3
90%待验证SD3引入了MMDiT(Multi-Modal Diffusion Transformer)架构,用Transformer替代了传统的U-Net骨干网络,并采用三重文本编码器(CLIP ViT-L、OpenCLIP ViT-bigG、T5-XXL)
90%待验证2023-2024年间,图像生成领域经历了从Stable Diffusion 1.5到SDXL再到SD3的架构跃迁
60%待验证CFG=4–4.5 是许多 Flux、SD3 系列模型的推荐起点区间,而 SDXL 类模型常用 5–8
50%待验证FLUX、SD3等模型通过引入文本编码器和更精细的训练数据改善了文字生成能力
50%待验证Stable Diffusion 1.x使用4通道潜空间,SD3/FLUX等新一代模型升级至16通道
50%待验证人类心理测评中常用SD3(Short Dark Triad)等标准量表测量暗黑三角特质
50%待验证shift 值 2.8 遵循 SD3/RAE 的规则 √(32·32·32/4096) 计算,对应 FLUX.2 使用的 32 通道潜空间
50%