基准Massive Multidiscipline Multimodal Understanding
MMMU
多学科多模态理解基准测试,要求模型跨越医学、法律、艺术等30个学科回答需要图文联合推理的题目,是衡量模型通识视觉理解能力的核心评测指标之一
时间轴 (近 90 天)
9月29日
MMMU(Massive Multidiscipline Multimodal Understanding)要求模型跨越医学、法律、艺术等30个学科回答需要图文联合推理的题目
待验证50%
9月11日
视觉语言模型的常见评测基准包括VQAv2、MMBench、MMMU、TextVQA以及MME
待验证50%