Unverified60% confidenceFactExact time
GPT-5.2 Codex scores slightly higher than GPT-5.2 on SWBench Pro and about 2 percentage points higher on Terminal Bench.
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Related Claims
VerifiedGPT-5.4在SWE-Bench Pro测试中拿下57.7%准确率,超越了GPT-5.3-Codex的56.8%78% similarUnverifiedGPT-5.6 Sol在CursorBench上取得了67.2%的得分77% similarUnverifiedGPT 5.5 leads on TerminalBench 2.0 with a score of 87%, surpassing even Anthropic's unreleased Mythos model76% similarPartially VerifiedOpenAI 称 GPT-5.6 在 Terminal Bench 2.1 上达到当前最强水平74% similarUnverifiedGPT-5.6在Terminal-Bench 2.1编码榜单上以Ultra配置取得91.9%的成绩72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/51093API
curl https://kongchang.com/api/v1/knowledge/claims/51093MCP
get_claim(id=51093)