Unverified50% confidenceBenchmarkExact time
在认知任务上人类可达约80%,而SOTA多模态模型仅有30%到50%,有时接近随机猜测
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/17/2026
First Seen
Valid until: 10/15/2026
Sources
Related Claims
Unverified在简单视觉感知任务上,普通人类能达到90%以上准确率,而多数SOTA模型只有50%甚至更低77% similarUnverified在AI作品占比不高(如仅5%)的场景下,即使检测准确率达90%,被标记的作品中超过三分之二实际上是人类创作,这属于贝叶斯推理中的基准率谬误75% similarUnverified研究表明在要求AI直接生成参考文献的任务中,幻觉率可高达40%-70%72% similarUnverified根据文中量化估算,编程智能体任务中模型推理仅占总时间的 20%-30%,剩余 70%-80% 花在等待外部系统 I/O 响应72% similarVerified研究表明即便是最先进的模型,在事实性问答任务中的幻觉率仍在5%-20%之间波动72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/544829API
curl https://kongchang.com/api/v1/knowledge/claims/544829MCP
get_claim(id=544829)