Unverified50% confidenceFactExact time
Stable Diffusion系列使用的图像VAE将512×512图像压缩为64×64的潜表示
1
Sources
50%
Confidence
Long-term
Relevance
8/29/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedImagen 基于级联扩散模型(Cascaded Diffusion Model)架构70% similarVerifiedJPEG图片压缩的核心算法是离散余弦变换(DCT),图片被分割成8×8像素的小块,每个块经过频域变换后高频细节信息被选择性丢弃66% similarUnverified在Midjourney所使用的扩散模型架构中,图像先在压缩的低维潜空间中完成逐步去噪,再通过解码器还原为完整图像65% similarUnverified科研图像生成通常使用Stable Diffusion系列或DALL·E等扩散模型作为渲染后端65% similarUnverified基于扩散模型的数据增强利用Stable Diffusion等生成模型将合成渲染图像风格化为更接近真实照片的外观,同时保留原有几何标注信息64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/816341API
curl https://kongchang.com/api/v1/knowledge/claims/816341MCP
get_claim(id=816341)