待验证50% 置信事实时间未知
在SaaS落地页生成测试中,四个模型(Claude Haiku 4.5、Claude Sonnet 4.0、Gemini 2.5 Pro、GPT-5)全部成功完成任务,但Haiku 4.5生成速度最快
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
Claude Haiku 4.5前端实测:三分之一价格吊打GPT-5?
bilibiliAI编程瓜哥
相关事实
待验证文章声称Claude Haiku 4.5在多项核心基准测试中击败了GPT-5和Gemini 2.5 Pro81% 相似待验证GPT-5 Mini在同类测试中表现远优于Claude 4.5 Haiku75% 相似已验证GPT-4、Claude 3.5 Sonnet、Gemini 1.5 Pro等新一代大语言模型在HumanEval、SWE-bench等代码能力基准测试上的得分已大幅超越此前版本73% 相似待验证旗舰模型(如GPT-4o、Claude 3.5 Sonnet)与轻量模型(如GPT-4o-mini、Claude Haiku)在价格上可相差10-20倍,但在大量常规任务上性能差距并不显著73% 相似待验证Supabase团队在4个模型(Claude Code/Opus 4.6、Sonnet 4.6、GPT 5.4、GPT 5.4 Mini)上进行了6个场景的对比测试,Skill+MCP组合在每个模型上都优于其他条件73% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/61071API
curl https://kongchang.com/api/v1/knowledge/claims/61071MCP
get_claim(id=61071)