待验证60% 置信事实精确时间
Sora 采用 Video Diffusion Transformer(DiT),将视频压缩为时空 Patch 后进行扩散过程建模
2
来源数
60%
置信度
长期有效
时效性
2026/7/15
首次发现
来源
相关事实
待验证Sora、Stable Video Diffusion等前沿视频生成模型均采用DiT或其变体84% 相似待验证Sora引入了视频压缩网络将视频压缩为低维的时空Patch,再在此空间中进行扩散生成81% 相似待验证OpenAI Sora 引入了视频压缩网络与 Transformer 结合的时空补丁机制,将视频拆解为跨越空间与时间的三维补丁78% 相似待验证Sora的核心突破在于将视频理解为时空补丁(spacetime patches)的序列,统一了不同分辨率和时长的处理方式78% 相似待验证2023年后,以Stable Video Diffusion、Sora为代表的时序扩散模型开始将视频理解为时空连续体,能够在潜空间中同时建模多帧之间的运动关系77% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/515693API
curl https://kongchang.com/api/v1/knowledge/claims/515693MCP
get_claim(id=515693)