Unverified60% confidencePredictionTime unknown
评测者表示Gemini Pro 2.5 0506可能在下个月被从评测中移除,因为其整体表现已明显落后于Claude系列模型
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
6/2/2026
First Seen
Valid until: 8/31/2026
Sources
AI编码助手深度评测:Copilot垫底,谁才是真正王者?
bilibili比特光锥_BightCone
Related Entities
Related Claims
UnverifiedGemini 2.5 Pro在Humanities Last Exam基准测试中得分18.8%,远超O3 Mini的14%和其他模型的10%以下70% similarUnverifiedGemini 3.1 Pro发布后,不少开发者对其表现感到失望,认为单次实力测试大幅下滑70% similarUnverifiedGemini最近存在降质问题,使用频率有所下降70% similarUnverifiedGemini 2.5 Pro在数学能力基准测试中与O3 Mini持平,两者都将其他模型远远甩在身后69% similarPartially VerifiedGemini 3.0 Pro的前端还原度被评为全场第一,但后端错误率较高69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/36730API
curl https://kongchang.com/api/v1/knowledge/claims/36730MCP
get_claim(id=36730)