Unverified50% confidenceFactExact time
数据污染问题源于LLM预训练语料来自Common Crawl等大规模网络爬取,可能包含公开的基准测试题目及答案
1
Sources
50%
Confidence
Long-term
Relevance
7/5/2026
First Seen
Sources
GeneBench-Pro:基因组学AI评测基准,科研能力新标尺
rss6/30/2026
Related Claims
Verified训练数据污染是AI编程基准测试面临的首要挑战,测试用例来自公开GitHub仓库而这些正是大模型预训练语料来源75% similarUnverified主流基准测试如MMLU、HumanEval、SWE-bench通常仅覆盖数千至数万个标准化问题,存在场景覆盖有限和训练数据污染的潜在风险71% similarUnverifiedLLM在预训练阶段见过海量网络诈骗话术和营销文案,具备对高风险语义模式的识别能力,可与进程行为特征联合判断71% similarUnverified数据污染检测的常用手段包括逐字完成测试和成员推断攻击67% similarUnverified针对网络安全数据专门训练的专用模型有望在漏洞识别准确率和误报率上超越通用模型67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/112396API
curl https://kongchang.com/api/v1/knowledge/claims/112396MCP
get_claim(id=112396)