Unverified50% confidenceFactExact time
DeepMind在VLA上叠加了一层Gemini模型,用户可直接用自然语言下达指令,机器人能一边工作一边对话
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/18/2026
First Seen
Valid until: 10/16/2026
Sources
Related Claims
UnverifiedDeepMind开发了VLA(视觉语言动作模型)系统,将机器人的物理动作与视觉token、语言token置于同等重要的位置处理81% similarUnverifiedGoogle DeepMind的SIMA项目训练了一个能够在多款3D游戏中执行自然语言指令的通用智能体77% similarVerifiedGoogle DeepMind在开发Gemini时采用了从头开始的多模态训练策略,使其能够直接理解视频中的时序变化和音频中的音调情感等非文本信息74% similarUnverifiedDeepMind开发了名为Genie的交互式世界模型系统74% similarUnverifiedDeepMind推出Auto-RT项目,将大语言模型与机器人控制模型RT-2结合,用LLM作为任务规划层将自然语言指令分解为底层动作序列71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/552111API
curl https://kongchang.com/api/v1/knowledge/claims/552111MCP
get_claim(id=552111)