待验证50% 置信基准精确时间
最终一轮实验中综合评估分数提升了0.0903,零分会话减少了40%
1
来源数
50%
置信度
长期有效
时效性
2026/10/2
首次发现
来源
涉及实体
相关事实
待验证消融分析显示片段范式微调在测试集带来+5.29分提升,而用2000检索词替换前4500转录词仅带来+1.55分提升76% 相似待验证测试损失与计算量之间的幂律指数约为0.05,意味着计算量每增加10倍,模型性能提升约12%73% 相似待验证在实验中,零样本生成任务解决率为17%,通用自我纠错为27%,仅错误反馈为23%,诊断性反例反馈(A-CEGIS)达到90%72% 相似待验证基于测量指标引入门控(gating)机制后,准确率从20.7%提升到36.9%,同时系统仍回答了全部对比中的一半70% 相似待验证当响应被冻结在初始策略时,增加提示广度将准确率从21.16%拉低到19.05%69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/966766API
curl https://kongchang.com/api/v1/knowledge/claims/966766MCP
get_claim(id=966766)