Veo是由Google DeepMind开发的视频生成AI模型,能够根据文本提示或图像输入生成高质量视频内容。该模型支持多种视觉风格和场景的视频合成,具备理解自然语言描述并将其转化为连贯视觉序列的能力,主要应用于创意内容制作、影视辅助生产等领域。
Sora、Veo等视频生成模型发布后,人们会关注物理一致性、物体永久性等细节
谷歌此前的Veo系列已在部分维度探索可控生成
Google的Veo和Runway的Gen-3是与Sora类似的视频生成模型
Google此前已有Veo 2和Imagen Video等视频生成模型
Google Flow基于Google DeepMind的Veo系列视频生成模型,提供图到视频功能