Unverified50% confidenceBenchmarkExact time
Claude Sonnet 系列在 SWE-bench 编程基准测试中持续领先,该测试模拟真实 GitHub 项目中的 bug 修复场景
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/6/2026
First Seen
Valid until: 10/4/2026
Sources
Claude Code深度解析:为何成为最强AI编程工具
bilibili小码学IT7/2/2026
Related Claims
UnverifiedGitHub Copilot CLI默认使用Claude Sonnet模型75% similarUnverifiedSonnet在编程能力方面表现突出,是Cursor、GitHub Copilot等AI编程工具后端的热门选择73% similarUnverifiedGitHub产品副总裁指出Sonnet 4.6在复杂代码修复方面表现出色,能帮助开发者解决大规模代码库中的问题70% similarVerifiedSWE-bench直接使用真实的GitHub Issue作为测试题目,要求模型在完整代码仓库中定位并修复Bug70% similarUnverifiedAnthropic的Claude Sonnet 4和Opus 4已全面集成至GitHub Copilot67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/114138API
curl https://kongchang.com/api/v1/knowledge/claims/114138MCP
get_claim(id=114138)