待验证60% 置信事实时间未知
Sora引入了视频压缩网络将视频压缩为低维的时空Patch,再在此空间中进行扩散生成
2
来源数
60%
置信度
长期有效
时效性
2026/5/31
首次发现
来源
Gemini Omni视频生成:文本图片视频混合输入一键合成
twitterGeminiApp
涉及实体
相关事实
待验证OpenAI Sora 引入了视频压缩网络与 Transformer 结合的时空补丁机制,将视频拆解为跨越空间与时间的三维补丁82% 相似待验证Sora 采用 Video Diffusion Transformer(DiT),将视频压缩为时空 Patch 后进行扩散过程建模81% 相似待验证OpenAI的Sora、Google的VideoPoet均采用将视频帧压缩为离散token后进行自回归预测的技术路线75% 相似待验证Sora的核心突破在于将视频理解为时空补丁(spacetime patches)的序列,统一了不同分辨率和时长的处理方式73% 相似待验证平台对外分发视频通常经历转码压缩降带宽和叠加可见及隐式水印两个处理步骤70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/4713API
curl https://kongchang.com/api/v1/knowledge/claims/4713MCP
get_claim(id=4713)