[控场AI]
基准General Language Understanding Evaluation / SuperGLUE

GLUE

通用语言理解评估基准,包含多项NLP任务(文本分类、推理、问答等),是衡量自然语言处理模型综合能力的权威基准之一。

来源文章