待验证50% 置信事实时间未知
The study tested AI coding performance across models including Sonnet 4.5, GPT 5.2, GPT 5.1 Mini, and Qwen 3
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
相关事实
待验证The five AI models tested were DeepSeek R1, Claude Sonnet 3.7, ChatGPT o3 Mini, Grok 3, and Qwen 2.5 Max.77% 相似待验证当前主流AI编程模型可分为三个能力层级:轻量级模型(如GPT-3.5、Claude Haiku)、中端模型(如Claude Sonnet、GPT-4o mini)和顶级模型(如GPT-4.5+、Claude Opus)77% 相似待验证该建筑师的AI编程工具经历了三个阶段:VSCode + GLM5、Claude Code(Sonnet 4.5)、GPT Codex桌面端77% 相似待验证The four models tested in the AI coding comparison were ChatGPT 5.4, Gemini 3.1, DeepSeek V4 Pro, and Kimi 5.176% 相似待验证Supabase团队在4个模型(Claude Code/Opus 4.6、Sonnet 4.6、GPT 5.4、GPT 5.4 Mini)上进行了6个场景的对比测试,Skill+MCP组合在每个模型上都优于其他条件75% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/57821API
curl https://kongchang.com/api/v1/knowledge/claims/57821MCP
get_claim(id=57821)