待验证50% 置信基准精确时间
在一个强化学习实验中,未设置识别虚假世界奖励时,数字生物判断自己是否处于虚拟世界的准确率仅约50%,接近随机猜测
1
来源数
50%
置信度
长期有效
时效性
2026/8/9
首次发现
来源
相关事实
待验证当研究者让虚假世界的物理规则影响食物捕获难度后,经过10轮测试,数字生物识别虚假世界的准确率从约50%跃升至约73%77% 相似待验证ItaSoRL实验中智能体的内部状态探测准确率仅约50%,等同于随机猜测水平64% 相似待验证2023年的多项Benchmark测试(如HaHackathon数据集)显示,顶级LLM在讽刺识别任务上的准确率仍显著低于普通人类标注者64% 相似待验证在机器学习多种子实验中重复次数通常只有5到10次,样本量极小,正态性假设难以验证,因此 Wilcoxon 检验往往是更保守稳健的选择62% 相似待验证泰特洛克的研究得出结论:专家预测的准确率仅略高于随机猜测,甚至不如简单的统计基准线62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/717713API
curl https://kongchang.com/api/v1/knowledge/claims/717713MCP
get_claim(id=717713)