待验证50% 置信事实精确时间
DeepMind在VLA上叠加了一层Gemini模型,用户可直接用自然语言下达指令,机器人能一边工作一边对话
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/18
首次发现
有效期至:2026/10/16
来源
相关事实
待验证DeepMind开发了VLA(视觉语言动作模型)系统,将机器人的物理动作与视觉token、语言token置于同等重要的位置处理81% 相似待验证Google DeepMind的SIMA项目训练了一个能够在多款3D游戏中执行自然语言指令的通用智能体77% 相似已验证Google DeepMind在开发Gemini时采用了从头开始的多模态训练策略,使其能够直接理解视频中的时序变化和音频中的音调情感等非文本信息74% 相似待验证DeepMind开发了名为Genie的交互式世界模型系统74% 相似待验证DeepMind推出Auto-RT项目,将大语言模型与机器人控制模型RT-2结合,用LLM作为任务规划层将自然语言指令分解为底层动作序列71% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/552111API
curl https://kongchang.com/api/v1/knowledge/claims/552111MCP
get_claim(id=552111)