Unverified50% confidenceFactExact time
批次归一化在训练模式使用当前批次统计量,在推理模式使用训练过程中累积的移动平均值
1
Sources
50%
Confidence
Long-term
Relevance
8/5/2026
First Seen
Sources
Related Claims
Unverified训练指标的周期性波动往往与训练数据的遍历方式有关,若每个epoch数据顺序固定或困难样本固定位置出现会导致规律性起伏78% similarUnverified最大似然估计训练目标等价于最小化模型分布与训练数据经验分布之间的KL散度78% similarUnverified2024年多项研究发现部分模型在标准基准上的优秀表现源于训练数据中混入了基准测试题目本身(数据污染)74% similarUnverifiedLLM的输出结果天然倾向于训练集中出现频率最高的模式组合,即统计意义上的最大公约数73% similarUnverified数据增强通过对训练样本施加随机变换(如旋转、翻转、缩放、裁剪、颜色抖动等)来人工扩大训练集规模,其理论基础是正则化73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/688917API
curl https://kongchang.com/api/v1/knowledge/claims/688917MCP
get_claim(id=688917)