Verified65% confidenceFactTime unknown
Stable Diffusion的文本引导通过CLIP文本编码器将提示词转化为向量
3
Sources
65%
Confidence
Long-term
Relevance
6/2/2026
First Seen
Sources
Stable Diffusion本地部署教程:免费无限制的AI绘画方案
bilibiliAI幻画师
Related Entities
Related Claims
Unverified在Stable Diffusion中,CLIP文本编码器将自然语言切分为最多77个token,每个token映射为768维或1024维嵌入向量79% similarUnverified早期Stable Diffusion系列以CLIP为文本编码器,对超过77个Token的提示词处理能力受限79% similarUnverifiedStable Diffusion 的核心原理是在压缩后的潜在空间中进行去噪生成,采用CLIP文本编码器理解提示词、U-Net架构执行去噪、VAE解码器还原图像的三段式流程78% similarVerified文本指令通过CLIP等跨模态编码器转化为语义向量,将文字和图像嵌入同一语义空间以引导图像生成76% similarVerified文本到图像的转换依赖于CLIP等多模态模型,将文本描述编码为向量来引导去噪过程76% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/36410API
curl https://kongchang.com/api/v1/knowledge/claims/36410MCP
get_claim(id=36410)