待验证90% 置信观点时间未知
博主给出的最终排名是Gemini第一、ChatGPT第二、Claude第三
1
来源数
90%
置信度
中期 (~90 天)
时效性
2026/6/1
首次发现
有效期至:2026/8/30
来源
ChatGPT vs Gemini vs Claude:谁能从零做出马里奥64?
bilibiliYT译片坊
涉及实体
相关事实
待验证Gemini 3.5 Pro在MMLU Pro基准测试中得分89.4分,领先GPT 5.5和Claude70% 相似待验证在Diamond子集中,Claude 3.0 Opus得分5.2%,Gemini 1.5 Pro得分4.7%,GPT-4o Mini得分4.6%,Kimi K2.6得分3.8%69% 相似待验证在综合性能排名中,Kimi K2.5得分64%,排名第五,前四名分别是Gemini 3 Pro(100%)、Claude Opus 4.5 Max(74%+)、GLM 4.7(65%)和GPT-5.2X(65%)68% 相似待验证在当前编程能力排名中,Claude Opus 4.7位居第一梯队,Claude Sonnet 4.6位居第二梯队,GPT系列和Gemini系列位居第四梯队66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/20083API
curl https://kongchang.com/api/v1/knowledge/claims/20083MCP
get_claim(id=20083)