待验证50% 置信事实精确时间
Sora、Stable Video Diffusion等前沿视频生成模型均采用DiT或其变体
1
来源数
50%
置信度
长期有效
时效性
2026/7/10
首次发现
来源
TensorRT多设备推理:突破单GPU显存瓶颈的工程实践
rss2026/6/25
相关事实
待验证Sora 采用 Video Diffusion Transformer(DiT),将视频压缩为时空 Patch 后进行扩散过程建模84% 相似已验证OpenAI 的 Sora 和 Stability AI 的 Stable Video Diffusion 均受 DiT 架构影响81% 相似待验证常见视频生成模型包括Kling、Wan、Sora、CogVideoX等,图像生成模型包括Stable Diffusion、FLUX等80% 相似待验证Sora、CogVideoX等主流视频生成模型普遍采用DiT或其变体架构,标志视频生成技术从UNet时代向Transformer时代过渡75% 相似待验证2023年后,以Stable Video Diffusion、Sora为代表的时序扩散模型开始将视频理解为时空连续体,能够在潜空间中同时建模多帧之间的运动关系75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/461706API
curl https://kongchang.com/api/v1/knowledge/claims/461706MCP
get_claim(id=461706)