待验证50% 置信事实精确时间
研究表明在某些开源Benchmark上头部大模型训练语料与评测数据的n-gram重叠率可高达15%~30%
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/10
首次发现
有效期至:2026/10/8
来源
大模型评测:测试行业最稀缺的转型方向与入场时机
bilibili宇宙Ai测试2026/7/6
相关事实
待验证研究团队在十亿参数规模的稀疏LLM上测得推理和训练速度提升超过20%69% 相似待验证Meta的LLaMA论文披露其训练数据中约67%来自Common Crawl,经过多轮过滤后仅保留原始数据的约15%68% 相似待验证实验采用8:2比例划分数据,20%作为内部测试集,训练集内部使用5折交叉验证,并移除重复记录以避免数据泄漏67% 相似待验证在提示中包含具体评估维度(如格式、字数、覆盖要点、排除事项)比模糊提示平均可提升模型输出质量30%-50%67% 相似待验证Scale AI在2024年的分析显示,部分模型在MMLU上的分数膨胀可能高达5-10个百分点,因测试集已泄露到训练数据中66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/421333API
curl https://kongchang.com/api/v1/knowledge/claims/421333MCP
get_claim(id=421333)