待验证50% 置信事实精确时间
VLA的代表性工作包括Google的RT-2(Robotics Transformer 2)和Physical Intelligence公司的π0模型
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
Vizuara机器人学习课程笔记获取指南与免费资源推荐
redditr/deeplearning2026/7/12
相关事实
待验证Google于2023年发布RT-2等视觉-语言-动作模型(VLA),将感知、语义理解与操作策略统一在同一Transformer框架中82% 相似待验证Google DeepMind的RT-2(2023年)将机器人动作词元化为离散token,附加到视觉-语言模型PaLI-X和PaLM-E的输出词汇表中,展现出零样本泛化能力63% 相似已验证Google在Switch Transformer中大规模验证了Mixture of Experts(MOE)架构62% 相似已验证谷歌2021年发布的Switch Transformer通过将路由简化为Top-1选择并引入专家容量机制缓解负载不均衡问题60% 相似待验证谷歌的RT-2、特斯拉的Optimus、国内的宇树科技是具身智能趋势的典型代表60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/502447API
curl https://kongchang.com/api/v1/knowledge/claims/502447MCP
get_claim(id=502447)