待验证50% 置信事实精确时间
测试的两个项目此前已用Claude Opus 4.5加GPT-5.5的组合写过一轮
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/18
首次发现
有效期至:2026/10/16
来源
相关事实
已验证M2.5在编程任务上跑出了接近Claude Opus 4.6和GPT-5.2等旗舰级模型的表现80% 相似待验证Composer 2.5在SweepBench多语言测试中与Claude Opus 4.7和GPT 5.5属于同一梯队78% 相似已验证ThePrimeagen在同一天测试了Claude Opus 4.6和GPT 5.3 Codex,用完全相同的任务进行编程对决77% 相似待验证GPT-5.6在知识工作、科学与健康领域测试全面领先Claude Opus及Opus 4.576% 相似待验证在多米诺骨牌物理模拟测试中,Opus 4.5使用一次提示即完成五个阵型设计,而GPT-5.2 Codex需要两次提示才达到基本可用状态76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/550732API
curl https://kongchang.com/api/v1/knowledge/claims/550732MCP
get_claim(id=550732)