Unverified50% confidenceBenchmarkExact time
Anthropic的研究显示,即使面对毫无根据的质疑,在某些测试中模型被用户简单反驳后放弃正确答案的比例超过50%
1
Sources
50%
Confidence
Long-term
Relevance
8/26/2026
First Seen
Sources
Related Entities
Related Claims
Unverified学术研究已证明,同样的问题以不同方式表达,模型的回答准确率可能相差20%以上72% similarUnverified测评题量与信度存在权衡:低于30题的『快测』因抽样不足信度偏低,但200题以上的专业量表易产生答题疲劳导致后半段随意作答,60-120题是兼顾信度与完成质量的区间72% similarUnverifiedAnthropic在2023年的论文中系统测量了奉承偏差,发现即便在明显错误前提下多数主流模型仍有相当比例的回复选择顺从用户71% similarUnverifiedAnthropic在2024年的研究论文中量化了模型过度拒绝现象,发现经过安全训练的模型在某些场景下拒绝率高达15-30%属于误判71% similarUnverifiedNeurIPS 2022一致性实验结果显示,约50%的论文在两组审稿人之间会得到截然不同的接收/拒绝决定70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/805073API
curl https://kongchang.com/api/v1/knowledge/claims/805073MCP
get_claim(id=805073)