Unverified50% confidenceFactExact time
监督学习本质上是函数逼近问题,通过最小化损失函数实现,常见损失函数包括回归任务的均方误差(MSE)和分类任务的交叉熵(Cross Entropy)
1
Sources
50%
Confidence
Long-term
Relevance
8/23/2026
First Seen
Sources
Related Entities
Related Claims
Verified分类任务常用交叉熵损失(Cross-Entropy Loss),回归任务常用均方误差(MSE)79% similarUnverified行为克隆将问题简化为监督学习,但存在分布偏移问题,导致训练时和执行时状态分布不同引发误差累积70% similarUnverified对比学习的核心损失函数(如InfoNCE、NT-Xent)本质是拉近同类样本表征距离、推远不同类样本表征距离70% similarUnverified分散损失属于表示学习正则化方法族群,相较对比学习和白化变换,其优势在于直接作用于嵌入几何且无需构造对比样本对68% similarUnverified交叉熵损失在分类任务中往往比MSE收敛更快,因为它与softmax输出配合,梯度不会在饱和区消失68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/789576API
curl https://kongchang.com/api/v1/knowledge/claims/789576MCP
get_claim(id=789576)