Unverified50% confidenceFactExact time
预处理泄漏在小数据集上尤为显著,当训练集仅有数百张图像时加入测试集样本会明显改变均值和标准差估计
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
深度学习数据归一化:全局统计 vs 逐图归一化实践指南
redditr/deeplearning7/9/2026
Related Claims
Verified若用含测试集的全量数据计算均值和标准差,会导致预处理泄漏,使评估指标虚高,无法真实反映模型泛化能力77% similarUnverified在稠密检索中,批内负样本训练要求批次包含有信息量的负样本,随机采样会导致训练损失快速收敛但泛化性能差76% similarVerified过拟合是指模型在训练数据上表现优异,但在未见过的测试数据上性能大幅下降的现象75% similarUnverified文生图模型的理解本质上是大规模统计关联,面对训练集中稀少出现的长尾概念时生成质量会显著下滑74% similarUnverified在收敛型任务上,模型达到一定规模后存在明显的性能饱和现象,参数量或训练数据的继续增加对准确率的边际贡献快速衰减74% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/502345API
curl https://kongchang.com/api/v1/knowledge/claims/502345MCP
get_claim(id=502345)