待验证50% 置信事实精确时间
RT-2(Robotics Transformer 2)直接用视觉-语言模型端到端生成机器人控制指令
1
来源数
50%
置信度
长期有效
时效性
2026/7/22
首次发现
来源
相关事实
已验证VLA将预训练的视觉-语言模型与机器人动作策略直接对接,使机器人能够将自然语言指令、摄像头图像与低级运动控制统一处理67% 相似待验证文生视频模型通常基于扩散变换器(Diffusion Transformer)架构,将运动先验与外观风格解耦处理61% 相似待验证一个开源项目将无标记机器人定位技术整合进避碰导纳控制器中,使人手推动机器人时能沿虚拟碰撞球体表面滑动61% 相似待验证LeRobot 3D 提供相机到机器人的标定流程,用户先手动完成初始对齐后系统用多尺度 ICP 算法将点云与机器人 URDF 网格模型配准优化外参61% 相似待验证该模型只需一句自然语言指令加一个普通 RGB 摄像头,机器人便能自主导航完成任务60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/586701API
curl https://kongchang.com/api/v1/knowledge/claims/586701MCP
get_claim(id=586701)