Unverified60% confidenceFactTime unknown
Gemini 3 Pro在UI设计师作品集测试中花了9分钟、消耗62,000个Token,结果依然很差
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
6/1/2026
First Seen
Valid until: 8/30/2026
Sources
前端UI生成实测:GLM 4.7、Claude Opus、Gemini、Minimax谁最强?
bilibiliGoldenSpiderAI
Related Entities
Related Claims
UnverifiedGemini 3.1 Pro发布后,不少开发者对其表现感到失望,认为单次实力测试大幅下滑71% similarUnverifiedGemini 3 Pro在五轮测试中总共消耗了22.3万个Token,是四个模型中最多的70% similarUnverifiedGemini 3在SWE-bench基准测试中智能体场景下的得分远超同类模型70% similarUnverifiedGemini 3.1 Pro High在SWE-bench测试中通过率为84.17%,排名第一,生成代码量为307,000行,Bug密度为614个/百万行代码,安全问题为210个/百万行代码69% similarUnverifiedGemini 3.1 Pro在跨项目迁移认证体系任务上总共花了五轮对话才勉强完成任务69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/20498API
curl https://kongchang.com/api/v1/knowledge/claims/20498MCP
get_claim(id=20498)