[控场AI]
模型Wan模型 / Wan Video

Wan

阿里巴巴通义实验室开源的视频生成基础模型,基于Diffusion Transformer(DiT)架构构建,将视频帧划分为16×16像素时空Patch进行处理

时间轴 (近 90 天)

9月23日

主流T2V模型包括Runway Gen系列、Sora、Kling、Wan等

待验证50%
9月19日

社区评论认为 Qwen 团队和 Wan 团队在真实数据集质量方面存在不足

待验证50%
9月19日

主流的开源视频模型如CogVideoX、Wan在相机控制上普遍存在响应不精确的问题

待验证50%
9月18日

加速LoRA技术已被广泛应用于Wan、HunyuanVideo等主流开源视频模型的本地部署加速

待验证50%
9月18日

与 Wan、CogVideoX 等同期模型相比,MiniMax 模型的参数规模较大,本地部署对硬件要求偏高

待验证50%
9月12日

主流可本地部署视频生成模型包括字节跳动的 CogVideoX、快手的 Wan,商业 API 方面有 Runway、Pika、Kling 等

待验证50%
9月12日

该创作者仍保留此前用 Wan 视频生成积累的一批 LoRA,认为其中一些无法替代

待验证50%
9月12日

Wan团队开源了角色动画模型Wan-Animate-2

待验证50%
9月11日

使用ti2v-5b Q5模型在960x544分辨率、81帧、20步设置下,每步仅耗时1.95秒,并剩余约3GB显存空闲

待验证50%
9月10日

阿里巴巴通义团队发布的Wan系列曾一度是开源视频生成的主流选择

待验证50%

全部知识事实 (10)

来源文章