待验证80% 置信事实时间未知
GPT 5.2在前沿科学基准的竞赛题中得分约77%,但在开放式研究任务中表现下降到约25%
1
来源数
80%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
GPT Image 1.5深度解析:多轮编辑稳定性与图像生成的根本性变革
bilibiliAI-seeker
涉及实体
相关事实
待验证在Artificial Analysis智能指数综合测试中,GPT-5.6性能比Claude Opus 4.5略低约0.9分,但成本几乎减半73% 相似待验证2023年斯坦福大学研究实验证明,当关键信息被放置于输入文档中间位置时,GPT-4的正确召回率相比首尾位置下降约20-30%72% 相似已验证从GPT-4到GPT-5.4,每token推理成本下降了约97%,这一变化发生在两年内71% 相似待验证GPT-5.4相对于GPT-5.2,单独声明出错的概率降低了33%,整个回复包含任何错误的概率降低了18%71% 相似待验证在max模式下GPT-5.6的得分反而略低于ultra,印证了过度思考现象70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/3866API
curl https://kongchang.com/api/v1/knowledge/claims/3866MCP
get_claim(id=3866)