Unverified50% confidenceFactExact time
当模型对某个训练样本的预测概率接近1时,该样本对应的交叉熵损失趋近于零,模型几乎无法获得梯度更新信号
1
Sources
50%
Confidence
Long-term
Relevance
8/25/2026
First Seen
Sources
Related Entities
Related Claims
Verified分类任务中的交叉熵损失本质上是对数似然函数的负值,最小化交叉熵等价于最大化模型对训练数据的对数似然77% similarUnverifiedAI生成假设的边际成本趋近于零,一旦模型训练完成每增加一条假设几乎不产生额外成本74% similarUnverifiedOpenAI的图表显示,在较低的测试时计算量下,模型对这道题的成功率接近零,只有在极长的推理链条下才偶尔成功70% similarUnverified困惑度是测试集上每个token平均负对数似然的指数,值越低代表模型对语料的预测越准确70% similarUnverified有限样本估计熵率面临系统性负偏差问题,插件估计量倾向于低估真实熵,可用Miller-Madow校正通过添加(k-1)/(2N)项补偿69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/797140API
curl https://kongchang.com/api/v1/knowledge/claims/797140MCP
get_claim(id=797140)