Unverified60% confidenceFactExact time
Sora 采用 Video Diffusion Transformer(DiT),将视频压缩为时空 Patch 后进行扩散过程建模
2
Sources
60%
Confidence
Long-term
Relevance
7/15/2026
First Seen
Sources
Related Claims
UnverifiedSora、Stable Video Diffusion等前沿视频生成模型均采用DiT或其变体84% similarUnverifiedSora引入了视频压缩网络将视频压缩为低维的时空Patch,再在此空间中进行扩散生成81% similarUnverifiedOpenAI Sora 引入了视频压缩网络与 Transformer 结合的时空补丁机制,将视频拆解为跨越空间与时间的三维补丁78% similarUnverifiedSora的核心突破在于将视频理解为时空补丁(spacetime patches)的序列,统一了不同分辨率和时长的处理方式78% similarUnverified2023年后,以Stable Video Diffusion、Sora为代表的时序扩散模型开始将视频理解为时空连续体,能够在潜空间中同时建模多帧之间的运动关系77% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/515693API
curl https://kongchang.com/api/v1/knowledge/claims/515693MCP
get_claim(id=515693)