待验证50% 置信事实精确时间
2024年发布的LiveCodeBench基准专门收集模型训练截止日期之后发布的竞赛新题以规避数据污染
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/25
首次发现
有效期至:2026/10/23
来源
通用AI崛起:从数学推理到竞赛编程的全面突破
redditr/singularity2026/7/11
相关事实
待验证LiveCodeBench基准于2024年发布,专门收集模型训练截止日期之后发布的竞赛新题,其设计者发现顶级模型性能普遍下降15-30%85% 相似已验证LiveCodeBench于2024年兴起,通过持续抓取LeetCode、Codeforces等竞赛平台新题目动态构建测试集以规避数据污染82% 相似待验证2024年发布的开源框架RouteLLM通过训练轻量分类器实现数据驱动的动态模型路由68% 相似待验证欧盟数据保护委员会(EDPB)于2023年专项调查多家AI服务商的训练数据采集合规性64% 相似待验证约2018年前后,基于统计语言模型的代码补全开始出现,能够根据上下文预测下一个token63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/614001API
curl https://kongchang.com/api/v1/knowledge/claims/614001MCP
get_claim(id=614001)