待验证50% 置信基准精确时间
GPT-5.6在知识工作、科学与健康领域测试全面领先Claude Opus及Opus 4.5
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/14
首次发现
有效期至:2026/10/12
来源
GPT-5.6发布:三款模型对标Claude,ChatGPT Work超级应用全解析
bilibiliAI-seeker2026/7/9
相关事实
待验证SWE-1.7被宣称在编程智能水平上已接近GPT-5.5和Claude Opus的表现78% 相似待验证在网络安全测试排名中,Claude Opus 4.6最初领先,GPT 5.5发布后与之持平,GPT 5.5 Cyber一度领先,最终Claude新预览版重回榜首77% 相似待验证测试的两个项目此前已用Claude Opus 4.5加GPT-5.5的组合写过一轮76% 相似已验证M2.5在编程任务上跑出了接近Claude Opus 4.6和GPT-5.2等旗舰级模型的表现75% 相似待验证GPT-5.5和Claude Opus 4.7在OpenRouter基准测试中占据智商最高位置,价格约5美元/百万Token74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/504395API
curl https://kongchang.com/api/v1/knowledge/claims/504395MCP
get_claim(id=504395)