待验证50% 置信基准精确时间
在贴吧小站项目评测中,Sol以83.95分居首,GLM 5.2以76.59分位列第二,Terra 75.97分排第三,Luna 68.56分排第四
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/17
首次发现
有效期至:2026/10/15
来源
相关事实
待验证GLM 5.2在Terminal Bench测试中得分81分,GLM 5.1得分63.5分,GPT 5.5得分84分,Opus 4.8得分85分69% 相似待验证在Exploit Bench网络安全基准上,Sol得分约76%,Mythos 5约78%66% 相似待验证在综合性能排名中,Kimi K2.5得分64%,排名第五,前四名分别是Gemini 3 Pro(100%)、Claude Opus 4.5 Max(74%+)、GLM 4.7(65%)和GPT-5.2X(65%)66% 相似待验证在综合基准测试中,So得55分(约78.6%),Terra得44分(约62.9%),Luna得31分(约44.3%)66% 相似待验证在Terminal Bench 2.1基准测试上,GPT-5.6 Sol的Ultra模式接近92%,超越竞品的88%表现66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/547401API
curl https://kongchang.com/api/v1/knowledge/claims/547401MCP
get_claim(id=547401)