待验证75% 置信事实时间未知
Anthropic声称Sonnet 4.5在编码任务上超越了GPT-5
1
来源数
75%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
Claude 4.5 Sonnet实测:一条指令构建完整AI视觉应用
bilibiliUltralytics
涉及实体
相关事实
待验证GPT-5的项目理解深度为文件级别,而Claude Sonnet 4达到代码库级别75% 相似待验证在全局配置开头加入自我介绍(如「我是 Theo,你是我的代理」)能缓解 GPT-5.6、Sonnet、Opus 5 等模型过于积极、在不需要时急着大量编码的问题73% 相似待验证根据Anthropic官方数据,Haiku 4.5在SWEbench上击败了Sonnet 4,甚至超过了GPT-573% 相似待验证该建筑师的AI编程工具经历了三个阶段:VSCode + GLM5、Claude Code(Sonnet 4.5)、GPT Codex桌面端73% 相似待验证在SWE-bench软件工程任务基准测试上,Claude 3.5 Sonnet和GPT-4o的任务完成率远超开源模型72% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/24173API
curl https://kongchang.com/api/v1/knowledge/claims/24173MCP
get_claim(id=24173)