待验证50% 置信事实精确时间
SFT 导致的真定理识别能力崩溃现象在四个随机种子上重复实验均观察到,并在 Gemma-3-4B 上复现
1
来源数
50%
置信度
长期有效
时效性
2026/10/5
首次发现
来源
涉及实体
相关事实
待验证使用稀疏的仅基于最终结果的强化学习奖励信号,模型修复了被 SFT 破坏的真定理识别能力并将识别率提升到 0.66,超越基础模型65% 相似待验证PAWS的回放研究揭示高准确率可能掩盖模型对罕见利益相关方行为的检测失败64% 相似已验证模型量化从FP32降至INT8能将推理速度提升3-4倍,但可能导致小目标检测精度下降63% 相似待验证在更新事实任务中,嵌入检索方法表现出不可预测的崩溃,成功率在0.30-0.95之间波动,不同随机种子间最大差距达0.4561% 相似待验证对 SO(3)/SE(3) 群运算做可微化处理时,暴露出仅通过检查前向数值难以发现的数值问题,修复后普通 NumPy 实现也一并得到改善60% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/975473API
curl https://kongchang.com/api/v1/knowledge/claims/975473MCP
get_claim(id=975473)