待验证50% 置信事实精确时间
Google的RT-2使用预训练的视觉-语言模型(如PaLI)作为backbone联合编码图像观察和自然语言指令,并在输出端生成离散化的动作token
1
来源数
50%
置信度
长期有效
时效性
2026/9/8
首次发现
来源
涉及实体
引用此条事实
Stable URI
https://kongchang.com/claim/880242API
curl https://kongchang.com/api/v1/knowledge/claims/880242MCP
get_claim(id=880242)