Unverified50% confidenceOpinionExact time
基于开源代码库的评测存在数据污染问题,因为这些代码库可能已被纳入大模型的训练数据
1
Sources
50%
Confidence
Long-term
Relevance
9/12/2026
First Seen
Sources
Related Entities
Related Claims
Verified专用编程模型的训练数据来源包括GitHub开源代码、编程竞赛题解、技术文档、代码审查记录等,并针对HumanEval、MBPP、SWE-bench等基准测试进行优化79% similarVerified训练数据污染是AI编程基准测试面临的首要挑战,测试用例来自公开GitHub仓库而这些正是大模型预训练语料来源79% similarUnverified数据污染问题源于LLM预训练语料来自Common Crawl等大规模网络爬取,可能包含公开的基准测试题目及答案75% similarUnverified代码评估中的信息泄露形式包括测试用例可见性泄露、环境元数据泄露和训练数据污染75% similarUnverifiedLLM代码审计基于训练阶段学习的代码模式和已知漏洞样本进行推理,难以进行跨文件、跨函数调用链的精确状态追踪72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/917814API
curl https://kongchang.com/api/v1/knowledge/claims/917814MCP
get_claim(id=917814)