待验证50% 置信事实精确时间
VLA 模型将视觉感知、语言理解与机器人动作规划整合在统一模型中,通常以预训练的大型视觉语言模型为骨干,代表性工作包括 Google 的 RT-2 和 OpenVLA
1
来源数
50%
置信度
长期有效
时效性
2026/9/11
首次发现
来源
涉及实体
相关事实
已验证LLaVA(Large Language and Vision Assistant)是学术界最具影响力的开源视觉语言模型之一68% 相似待验证大模型 API 是指 OpenAI、Anthropic、百度文心、阿里通义等厂商将训练好的大型语言模型能力以接口形式对外开放,企业只需调用接口即可获得文本生成、理解、推理等能力67% 相似待验证LM Studio原生兼容OpenAI标准API,支持每个模型独立配置对话模板和模型长驻显存66% 相似已验证vLLM is a local model service that provides OpenAI-compatible APIs66% 相似已验证开源多模态模型LLaVA、InternVL、Qwen-VL通常采用'视觉编码器+投影层+语言模型'的架构66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/901258API
curl https://kongchang.com/api/v1/knowledge/claims/901258MCP
get_claim(id=901258)