待验证75% 置信事实时间未知
根据Anthropic发布的基准测试数据,Sonnet 4.5在编码能力上略优于Claude Opus 4.1
1
来源数
75%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Claude Code 2.0评测:Rewind回滚、Usage监控等实用新功能解析
bilibiliGoldenSpiderAI
涉及实体
相关事实
待验证在智能体搜索测试中,Sonnet 5 各 effort level 下均优于 Sonnet 4.6,但整体性能低于 Opus 4.8,综合约在 Opus 4.7 级别85% 相似待验证在 Cognition 推出的第三方基准 Frontier Code 上,Sonnet 5 超越了 Opus 4.881% 相似部分验证官方称Sonnet 5在推理、工具使用、编码和知识工作方面相比Sonnet 4.6均有显著提升,整体性能已逼近OPUS 4.8但价格更低78% 相似待验证Anthropic表示Sonnet 4.6在提示注入抵抗能力方面的表现与Opus 4.6相当77% 相似待验证国产模型中编程能力最强的GLM 5.1,实测水平大致处于Claude Opus 4.5和Sonnet 4.6之间76% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/24199API
curl https://kongchang.com/api/v1/knowledge/claims/24199MCP
get_claim(id=24199)