Unverified50% confidenceFactExact time
Stable Diffusion基于LAION-5B数据集训练,采用U-Net架构作为去噪骨干网络,配合CLIP文本编码器实现文本到图像的语义映射
1
Sources
50%
Confidence
Long-term
Relevance
8/27/2026
First Seen
Sources
Related Entities
Related Claims
Unverified主流扩散模型通常结合U-Net骨干网络与CLIP文本编码器73% similarUnverified主流文生图模型如Stable Diffusion、Midjourney、DALL-E的底层架构通常是扩散模型与CLIP文本编码器的结合69% similarVerifiedStable Diffusion的文本引导通过CLIP文本编码器将提示词转化为向量68% similarUnverified文本扩散采用掩码扩散(Masked Diffusion)方案,用[MASK]token替代真实token模拟损坏状态,再训练模型恢复原始文本,以块为单位并行输出64% similarUnverifiedCollapse训练借鉴CBOW完形填空思路,读取名词token前后各5个token的上下文,用余弦相似度直接与井比较预测,无需独立解码器64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/807875API
curl https://kongchang.com/api/v1/knowledge/claims/807875MCP
get_claim(id=807875)