待验证50% 置信基准精确时间
在实验中,零样本生成任务解决率为17%,通用自我纠错为27%,仅错误反馈为23%,诊断性反例反馈(A-CEGIS)达到90%
1
来源数
50%
置信度
长期有效
时效性
2026/9/11
首次发现
来源
涉及实体
相关事实
待验证压测场景下错误率(Error Rate)通常要求低于0.1%73% 相似待验证测试的准确率数据在n=100样本量下误差约为±8-10个百分点(基于95%置信水平的二项分布置信区间)71% 相似待验证在实验中当提示超过50条后,人类的拦截率从17%骤降到5%,体现审批疲劳现象71% 相似待验证检测项越多单项成本越低,但假阳性率随项目数上升——40+项的大panel常出现多项弱阳性(0.35–0.7 kU/L),临床意义模糊,反而增加不必要的忌口焦虑;无明确症状时选10–20项精准panel优于盲测大panel69% 相似待验证在一个396个文件的大型混合职责项目上测试时,召回率几乎跌到零69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/897321API
curl https://kongchang.com/api/v1/knowledge/claims/897321MCP
get_claim(id=897321)