待验证50% 置信事实精确时间
DeepMind采用两个协同工作的模块:更擅长推理的ER模型(本质上是VLM)负责协调统筹,VLA模型负责执行物理动作
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/18
首次发现
有效期至:2026/10/16
来源
相关事实
待验证DeepMind开发了VLA(视觉语言动作模型)系统,将机器人的物理动作与视觉token、语言token置于同等重要的位置处理81% 相似待验证视觉-语言-动作模型(VLA)是具身智能的最新范式,代表性工作包括Google DeepMind的RT-2和Physical Intelligence的π077% 相似待验证DeepMind在VLA上叠加了一层Gemini模型,用户可直接用自然语言下达指令,机器人能一边工作一边对话71% 相似待验证代表性VLA模型工作包括Google DeepMind的RT-2和斯坦福的OpenVLA69% 相似待验证DeepMind的DreamerV1/V2/V3系列将潜空间梦境训练范式系统化,并在多个基准上验证了其有效性67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/552112API
curl https://kongchang.com/api/v1/knowledge/claims/552112MCP
get_claim(id=552112)