待验证40% 置信事实时间未知
Claude Opus 4.7在SWE Bench Pro上得分从53.4%提升至54.3%
1
来源数
40%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
Claude Opus 4.7深度实测:编码能力飙升,最强模型Mythos仍被封印
bilibili枫叶边城
涉及实体
相关事实
待验证Claude Opus 4.7在Cursor Bench上得分从58分飙升至70分84% 相似待验证Claude Opus 4.6在SWE-Bench Pro测试中得分为53.4%80% 相似待验证Claude Opus 4.8 scored 69.2% on SWEBench Pro, up from Opus 4.7's 64.3%80% 相似待验证据非官方爆料,Terminal Bench 3.0基准测试中Claude Opus 5 Max以43.5%的得分超越GPT-5.6-Sol的34.6%重登榜首74% 相似待验证Claude Opus 4.8 reached 85.9% on the GraphWalks 256K subset (up from 76.9% for 4.7) and 68.1% on the full 1-million-token version, nearly double Opus 4.7's score of 40.3%74% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/13835API
curl https://kongchang.com/api/v1/knowledge/claims/13835MCP
get_claim(id=13835)