待验证50% 置信基准精确时间
三代模型的预训练验证损失呈稳定下降趋势:2.87→2.78→2.59
1
来源数
50%
置信度
长期有效
时效性
2026/8/29
首次发现
来源
涉及实体
相关事实
待验证即使只有5-10%的训练样本存在错位,也会导致VLM模型在下游任务上出现显著的性能退化68% 相似待验证测试损失与计算量之间的幂律指数约为0.05,意味着计算量每增加10倍,模型性能提升约12%67% 相似待验证2018年之前的模型与2019年后采用Margin-based Loss的模型在同一基准上准确率可能相差5-10个百分点67% 相似待验证当模型对某个训练样本的预测概率接近1时,该样本对应的交叉熵损失趋近于零,模型几乎无法获得梯度更新信号67% 相似待验证消融实验显示,若继续训练主干通用知识掉10%、数学掉17.8%;若两塔共享权重则通用任务掉26%,其余指标全线崩溃67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/819747API
curl https://kongchang.com/api/v1/knowledge/claims/819747MCP
get_claim(id=819747)