Unverified50% confidenceTradeoffExact time
分布在决策边界附近的困难负样本对模型边界学习的贡献远大于远离边界的容易负样本
1
Sources
50%
Confidence
Long-term
Relevance
7/6/2026
First Seen
Sources
26M超轻量模型Needle:本地微调工具调用全流程实战
bilibili薛定猫AI7/3/2026
Related Claims
Unverified多个独立模型的分歧程度本质上是对数据标注难度的一种估计,高分歧样本往往对应边界案例或存在真实争议的问题75% similarUnverified离线RL的核心挑战是分布偏移,可能导致外推误差,使学到的策略在部署时表现远不如预期74% similarUnverified研究团队证明学习分布与真实分布之间的总变差距离可分解为初始化误差、Score误差和求解器离散化误差三项73% similarUnverified小模型在分布内高性能的同时存在分布外脆弱性,一旦推理时的工具描述措辞、参数命名或用户查询风格偏离训练集,成功率可能显著下滑72% similarUnverified在稠密检索中,批内负样本训练要求批次包含有信息量的负样本,随机采样会导致训练损失快速收敛但泛化性能差72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/121206API
curl https://kongchang.com/api/v1/knowledge/claims/121206MCP
get_claim(id=121206)