Project Genie是由DeepMind研发的基础世界模型(Foundation World Model),能够通过学习无标注的视觉数据(如游戏视频、现实场景)自动生成可交互的虚拟环境。其核心能力包括:从单张图像或视频帧推断出具有物理交互逻辑的动态场景,以及支持用户以动作指令控制生成环境中的角色行为。该项目旨在为通用人工智能代理的训练提供可扩展的虚拟交互平台,是生成式AI与强化学习交叉领域的代表性研究成果。
Project Genie是谷歌DeepMind推出的基础世界模型(Foundation World Model)项目
谷歌近日宣布扩展Project Genie的全球访问范围,面向Google AI Ultra订阅用户开放
Project Genie引入了由Google Street View驱动的模拟真实世界地点的全新能力
Project Genie此前已展示了从单张图片生成可玩游戏关卡的能力
Project Genie的核心能力是通过AI从图像、文本等输入中生成可交互的虚拟环境,不需要开发者手动搭建场景