待验证50% 置信事件精确时间
通应实验室推出了Coin VLA视觉语言动作模型,专注于通用具身智能
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
XAI发布Grok Build编程模型,Gemini Spark向Ultra用户开放
bilibiliinfinite灵感港2026/5/30
相关事实
已验证VLA将预训练的视觉-语言模型与机器人动作策略直接对接,使机器人能够将自然语言指令、摄像头图像与低级运动控制统一处理76% 相似待验证通用实验室(Tongying Lab)发布了视觉-语言-动作(Vision-Language-Action)模型76% 相似待验证具身智能当前主流技术路线是视觉-语言-动作模型(VLA),将摄像头图像与语言指令共同输入,直接输出机械臂的关节控制信号72% 相似部分验证LLaVA用一个简单的线性层连接视觉编码器和语言模型,证明了视觉指令微调的有效性69% 相似待验证当前主流 VLM 经过大规模 UI 截图数据训练,能够识别界面元素的层级关系,将视觉布局映射为功能语义68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/51225API
curl https://kongchang.com/api/v1/knowledge/claims/51225MCP
get_claim(id=51225)