Unverified50% confidenceOpinionTime unknown
在当前编程能力排名中,Claude Opus 4.7位居第一梯队,Claude Sonnet 4.6位居第二梯队,GPT系列和Gemini系列位居第四梯队
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
Claude Opus 4.7发布:编程性能提升20%,同价不涨,国产模型差距再拉大
bilibili库洛米大人的大人
Related Entities
Related Claims
VerifiedClaude Sonnet 5 在 SWE-bench Verified(Agentic Coding)上得分 63.22%,距 Opus 4.8 约差 6 个百分点70% similarUnverifiedClaude Sonnet 4.6在办公任务评测中以1633分位居榜首,超越包括Opus 4.6在内的所有竞争模型70% similarUnverified在智能体搜索测试中,Sonnet 5 各 effort level 下均优于 Sonnet 4.6,但整体性能低于 Opus 4.8,综合约在 Opus 4.7 级别69% similarPartially VerifiedClaude Opus 4.8在SWE-bench基准测试中得分69.2%,GPT 5.5为58.6%,Google Gemini为54.2%69% similarVerifiedClaude 3.5 Sonnet支持200K token上下文,GPT-4 Turbo支持100K token上下文68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/13833API
curl https://kongchang.com/api/v1/knowledge/claims/13833MCP
get_claim(id=13833)