待验证50% 置信基准精确时间
DeepSeek-V3发布时在多项基准测试中与Claude 3.5 Sonnet持平甚至超越,训练成本据报道仅为主流闭源模型的数分之一
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/7
首次发现
有效期至:2026/10/5
来源
Anthropic如何一步步失去开发者信任:定价、透明度与供应商锁定
hackernewshackernews2026/7/6
相关事实
待验证经过对比测试,DeepSeek V4 Pro的编程效果甚至超过了Claude Sonnet,而且价格便宜得多75% 相似待验证GLM-4.7在代码能力基准测试中超过DeepSeek V3.2及Claude Sonnet 4.571% 相似待验证一些开源或轻量级模型(如Mistral、Llama系列通过第三方托管)的调用成本可能只有Claude 3.5 Sonnet的十分之一甚至更低70% 相似待验证DeepSeek与Claude Sonnet在SWE-bench编码基准测试上的差距仅在1%以内67% 相似已验证Claude 3.5 Sonnet在SWE-bench等代码基准测试中长期领先66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/170418API
curl https://kongchang.com/api/v1/knowledge/claims/170418MCP
get_claim(id=170418)