[控场AI]
模型

Gemini Omni

Gemini Omni是Google开发的多模态大型AI模型,属于Gemini模型系列。该模型能够同时处理和理解文本、图像、音频、视频等多种模态的输入信息,并生成相应的多模态内容输出。其核心特征包括跨模态理解与推理能力、对现实世界物理规律的建模能力,以及在复杂多模态任务中的综合处理能力,适用于多种生成式AI应用场景。

核心事实

时间轴 (近 90 天)

9月9日

在骑士与武士对决测试中,Sora在角色动作真实度上优于Gemini Omni

待验证50%
7月6日

Gemini Omni Flash已通过Gemini API和Google AI Studio向开发者开放

已验证65%

全部知识事实 (9)

来源文章