Unverified50% confidenceFactExact time
训练指标的周期性波动往往与训练数据的遍历方式有关,若每个epoch数据顺序固定或困难样本固定位置出现会导致规律性起伏
1
Sources
50%
Confidence
Long-term
Relevance
8/6/2026
First Seen
Sources
Related Claims
Unverified批次归一化在训练模式使用当前批次统计量,在推理模式使用训练过程中累积的移动平均值78% similarUnverified传统大模型训练高度依赖人工标注数据和外部语料收集,这些步骤通常是制约迭代速度的瓶颈75% similarUnverified行为克隆存在分布偏移(Distribution Shift)问题:训练时策略只接触专家轨迹覆盖的状态分布,部署时微小偏差累积会使实际访问的状态分布逐渐偏离训练分布73% similarUnverified数据增强通过对训练样本施加随机变换(如旋转、翻转、缩放、裁剪、颜色抖动等)来人工扩大训练集规模,其理论基础是正则化72% similarUnverified一个高质量的路由器往往需要数千到数万条标注样本来训练,且决策边界会随底层模型更新而失效需持续重训72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/692748API
curl https://kongchang.com/api/v1/knowledge/claims/692748MCP
get_claim(id=692748)