Unverified50% confidenceFactExact time
主流文生图模型如Stable Diffusion、Midjourney、DALL-E的底层架构通常是扩散模型与CLIP文本编码器的结合
1
Sources
50%
Confidence
Long-term
Relevance
7/6/2026
First Seen
Sources
AI漫剧制作全流程:从剧本到脚本的实战指南
bilibili绘梦_无用师7/4/2026
Related Claims
Unverified主流扩散模型通常结合U-Net骨干网络与CLIP文本编码器78% similarUnverifiedMidjourney使用CLIP的文本编码器将提示词转换为条件向量,引导扩散模型的去噪过程74% similarVerifiedStable Diffusion的文本引导通过CLIP文本编码器将提示词转化为向量72% similarUnverified主流Embedding模型(如BGE、text-embedding系列)通常基于BERT架构的编码器(Encoder-only),通过对比学习让语义相近的句子在向量空间中靠拢;而GPT类生成模型基于解码器(Decoder-only)69% similarUnverified结构清晰的规格文档能够收窄大语言模型的输出空间,解决AI输出质量不稳定的问题68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/114498API
curl https://kongchang.com/api/v1/knowledge/claims/114498MCP
get_claim(id=114498)