待验证50% 置信事实精确时间
2021年发表于《Nature Machine Intelligence》的一项系统综述分析了2010-2019年间COVID-19影像诊断相关的415个机器学习模型,发现大量模型因数据泄漏、不当的训练-测试划分或数据集偏差而无法在临床中实际使用
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
待验证2024年研究表明即使AI生成内容仅占训练数据的10-20%,在多代训练后也足以引发可测量的质量退化67% 相似待验证2022年Hoffman等人的Chinchilla论文重新校准了算力最优的参数-数据比例,指出此前许多大模型训练不充分66% 相似待验证谷歌DeepMind团队在2022年的研究中记录了超过150种在小模型中缺失、却在大模型中出现的能力,包括多步推理、类比迁移与少样本学习66% 相似待验证美团技术团队发布General 365推理评测基准,对26款主流大模型进行测试,大部分模型未能达到60分及格线65% 相似待验证Scale AI在2024年的分析显示,部分模型在MMLU上的分数膨胀可能高达5-10个百分点,因测试集已泄露到训练数据中65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/567692API
curl https://kongchang.com/api/v1/knowledge/claims/567692MCP
get_claim(id=567692)