Unverified50% confidenceFactExact time
把置信度当作知识的代理指标是许多评测、幻觉检测和不确定性估计方法的隐含前提
1
Sources
50%
Confidence
Long-term
Relevance
9/25/2026
First Seen
Sources
Related Entities
Related Claims
Unverified多智能体系统中的验证可信度问题存在风险:代理可能因理解偏差、幻觉或执行失败而错误报告测试通过76% similarUnverified微调后的评测需要覆盖足够宽泛的知识面,尤其关注与微调领域关联的周边知识是否出现泄漏或矛盾73% similarUnverified人类评估者往往对流畅、自信、符合直觉的回答给予更高评分,这是奉承偏差(Sycophancy)的形成根源71% similarUnverified自信度阈值机制与学术界的Calibration(置信度校准)概念一脉相承,好的模型不仅要答得对,还要知道自己什么时候可能答错71% similarUnverified评估AI预测可信度应看说话者的利益相关性、判断的具体性和时间检验三个维度70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/949193API
curl https://kongchang.com/api/v1/knowledge/claims/949193MCP
get_claim(id=949193)