Unverified50% confidenceBenchmarkExact time
在 Cognition 推出的第三方基准 Frontier Code 上,Sonnet 5 超越了 Opus 4.8
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/20/2026
First Seen
Valid until: 10/18/2026
Sources
Related Claims
Unverified根据Anthropic发布的基准测试数据,Sonnet 4.5在编码能力上略优于Claude Opus 4.181% similarUnverified在SWE-Bench Pro基准上,Sonnet 5明显落后于Opus 4.878% similarPartially Verified官方称Sonnet 5在推理、工具使用、编码和知识工作方面相比Sonnet 4.6均有显著提升,整体性能已逼近OPUS 4.8但价格更低75% similarUnverified测试者认为Claude 3.5 Sonnet可能是Anthropic的一次'幸运一击',此后的Sonnet 3.7、Sonnet 4、Sonnet 4.5都没有实现真正的突破74% similarUnverifiedAnthropic可能直接跳过了Sonnet 4.7,从4.6直接升级到4.874% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/571453API
curl https://kongchang.com/api/v1/knowledge/claims/571453MCP
get_claim(id=571453)