待验证50% 置信观点时间未知
在当前编程能力排名中,Claude Opus 4.7位居第一梯队,Claude Sonnet 4.6位居第二梯队,GPT系列和Gemini系列位居第四梯队
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
Claude Opus 4.7发布:编程性能提升20%,同价不涨,国产模型差距再拉大
bilibili库洛米大人的大人
涉及实体
相关事实
已验证Claude Sonnet 5 在 SWE-bench Verified(Agentic Coding)上得分 63.22%,距 Opus 4.8 约差 6 个百分点70% 相似待验证Claude Sonnet 4.6在办公任务评测中以1633分位居榜首,超越包括Opus 4.6在内的所有竞争模型70% 相似待验证在智能体搜索测试中,Sonnet 5 各 effort level 下均优于 Sonnet 4.6,但整体性能低于 Opus 4.8,综合约在 Opus 4.7 级别69% 相似部分验证Claude Opus 4.8在SWE-bench基准测试中得分69.2%,GPT 5.5为58.6%,Google Gemini为54.2%69% 相似已验证Claude 3.5 Sonnet支持200K token上下文,GPT-4 Turbo支持100K token上下文68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/13833API
curl https://kongchang.com/api/v1/knowledge/claims/13833MCP
get_claim(id=13833)