已验证65% 置信基准精确时间
MMLU(Massive Multitask Language Understanding)基准包含超过1.4万道题目
3
来源数
65%
置信度
长期有效
时效性
2026/7/21
首次发现
来源
相关事实
待验证MMLU衡量多任务语言理解、HumanEval衡量代码生成、MATH衡量数学推理69% 相似待验证上下文窗口决定模型单次能处理的文本量:8K约6000词,32K约24000词,128K可处理整本书内容60% 相似待验证Wanxing Mind Map supports up to 100,000 characters of contextual parsing in a single pass.59% 相似待验证向量数据库通过嵌入模型(如OpenAI的text-embedding-3-large或开源的BGE-M3)将文本转化为数百至数千维的浮点数向量,向量距离对应语义相似度58% 相似待验证现代LLM的分词器通常将文本压缩为约10万词汇量的Token序列58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/579839API
curl https://kongchang.com/api/v1/knowledge/claims/579839MCP
get_claim(id=579839)