基准Massive Text Embedding Benchmark
MTEB
MTEB(Massive Text Embedding Benchmark)是一个大规模文本嵌入模型评估基准,由Hugging Face等机构联合提出。它涵盖分类、聚类、语义文本相似度、检索、重排序等多种自然语言处理任务,支持多种语言,旨在对文本嵌入模型进行全面、系统的性能评测。MTEB附有公开排行榜,供研究者和开发者比较不同嵌入模型的综合表现,是该领域广泛采用的标准评估工具。
时间轴 (近 90 天)
8月25日
BGE和E5系列在MTEB基准测试上表现出色,其中BGE-M3支持多语言、多粒度和多功能检索
待验证50%