Unverified80% confidenceFactTime unknown
GPT 5.2在前沿科学基准的竞赛题中得分约77%,但在开放式研究任务中表现下降到约25%
1
Sources
80%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
GPT Image 1.5深度解析:多轮编辑稳定性与图像生成的根本性变革
bilibiliAI-seeker
Related Entities
Related Claims
Unverified在Artificial Analysis智能指数综合测试中,GPT-5.6性能比Claude Opus 4.5略低约0.9分,但成本几乎减半73% similarUnverified2023年斯坦福大学研究实验证明,当关键信息被放置于输入文档中间位置时,GPT-4的正确召回率相比首尾位置下降约20-30%72% similarVerified从GPT-4到GPT-5.4,每token推理成本下降了约97%,这一变化发生在两年内71% similarUnverifiedGPT-5.4相对于GPT-5.2,单独声明出错的概率降低了33%,整个回复包含任何错误的概率降低了18%71% similarUnverified在max模式下GPT-5.6的得分反而略低于ultra,印证了过度思考现象70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/3866API
curl https://kongchang.com/api/v1/knowledge/claims/3866MCP
get_claim(id=3866)