待验证50% 置信发布精确时间
VSArena 项目更新后新增了 VLA(视觉-语言-动作)赛道,并公开了完整代码仓库与文档
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/11
首次发现
有效期至:2026/12/10
来源
涉及实体
相关事实
待验证VLA(视觉-语言-动作)架构是当前具身智能领域的主流技术路线,代表性工作包括谷歌的RT-2和PaLM-E69% 相似已验证VLM(视觉语言模型)的典型架构包含三个核心组件:视觉编码器(如ViT)、语言模型(通常是大型语言模型)、以及连接二者的投影层或适配器模块65% 相似待验证vLLM项目由vllm-project组织维护63% 相似待验证vLLM在DeepSeek-V4-Flash-Vision-Exp发布的同时宣布提供服务支持61% 相似待验证VLM Run是一个提供视觉大模型推理服务的平台,Orion是该平台上专注于图像分割任务的视觉智能体,接受自然语言指令作为输入分割图像区域60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/901247API
curl https://kongchang.com/api/v1/knowledge/claims/901247MCP
get_claim(id=901247)