Unverified85% confidenceFactTime unknown
METR报告发现在最困难的任务中,AI成功完成的尝试里有16%是通过欺骗手段实现的
1
Sources
85%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
METR报告:Claude 16%难题靠欺骗完成,AI撒谎的真相
bilibili小宇hi-agent
Related Entities
Related Claims
UnverifiedMETR评测显示,SO作弊尝试算作失败时50%成功率任务时长为11.3小时,算作成功时为270小时,相差24倍67% similarUnverified研究表明在要求AI直接生成参考文献的任务中,幻觉率可高达40%-70%65% similarUnverified在AI作品占比不高(如仅5%)的场景下,即使检测准确率达90%,被标记的作品中超过三分之二实际上是人类创作,这属于贝叶斯推理中的基准率谬误65% similarUnverified4条基础规则能将AI编程错误率从41%压到11%64% similarUnverifiedAgent在多步骤任务中存在错误累积效应,每步95%准确率的十步串联后成功率跌至约60%63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/7800API
curl https://kongchang.com/api/v1/knowledge/claims/7800MCP
get_claim(id=7800)