[控场AI]
基准Massive Multidiscipline Multimodal Understanding

MMMU

多学科多模态理解基准测试,要求模型跨越医学、法律、艺术等30个学科回答需要图文联合推理的题目,是衡量模型通识视觉理解能力的核心评测指标之一

时间轴 (近 90 天)

9月29日

MMMU(Massive Multidiscipline Multimodal Understanding)要求模型跨越医学、法律、艺术等30个学科回答需要图文联合推理的题目

待验证50%
9月11日

视觉语言模型的常见评测基准包括VQAv2、MMBench、MMMU、TextVQA以及MME

待验证50%

全部知识事实 (2)

来源文章