Unverified50% confidenceFactExact time
VLA的代表性工作包括Google的RT-2(Robotics Transformer 2)和Physical Intelligence公司的π0模型
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
Vizuara机器人学习课程笔记获取指南与免费资源推荐
redditr/deeplearning7/12/2026
Related Claims
UnverifiedGoogle于2023年发布RT-2等视觉-语言-动作模型(VLA),将感知、语义理解与操作策略统一在同一Transformer框架中82% similarUnverifiedGoogle DeepMind的RT-2(2023年)将机器人动作词元化为离散token,附加到视觉-语言模型PaLI-X和PaLM-E的输出词汇表中,展现出零样本泛化能力63% similarVerifiedGoogle在Switch Transformer中大规模验证了Mixture of Experts(MOE)架构62% similarVerified谷歌2021年发布的Switch Transformer通过将路由简化为Top-1选择并引入专家容量机制缓解负载不均衡问题60% similarUnverified谷歌的RT-2、特斯拉的Optimus、国内的宇树科技是具身智能趋势的典型代表60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/502447API
curl https://kongchang.com/api/v1/knowledge/claims/502447MCP
get_claim(id=502447)