待验证50% 置信事实精确时间
Wan 2.2 TI2V(Text-Image to Video)是一类以图像加文字为输入、生成连续视频帧的多模态生成模型
1
来源数
50%
置信度
长期有效
时效性
2026/9/14
首次发现
来源
涉及实体
相关事实
待验证图生视频(I2V)通过提供起始帧图像,相比纯文本生成视频(T2V)显著提升了输出的可控性和质量74% 相似待验证万象视频生成模型支持文本生成视频(Text-to-Video)和图像生成视频(Image-to-Video)两种生成模式73% 相似待验证VideoViT 是将 Vision Transformer 架构扩展至视频域的技术路线,通过在时间维度引入注意力机制建模帧间关系,并使用 Tubelet Embedding 将连续帧时空体素化为三维 patch72% 相似待验证Wan-Animate-2新增了通过文字修改镜头视角的能力,参考正面动作视频时可用文字要求生成侧面或其他镜头角度的效果72% 相似待验证字节跳动开源了基于 Wan 2.2 训练的 Bernini 视频编辑模型70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/919987API
curl https://kongchang.com/api/v1/knowledge/claims/919987MCP
get_claim(id=919987)