待验证50% 置信基准精确时间
Luna在Artificial Analysis编程智能体指数上超过了Opus 4.8
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/11
首次发现
有效期至:2026/10/9
来源
GPT-5.6全面开放:Sol/Terra/Luna三档模型与四智能体并行深度解析
bilibili五里墩茶社2026/7/9
相关事实
待验证Gemini 3.5 Pro在ARC-AGI-2通用智能评估中得分42分,远超同期竞品66% 相似待验证Luna 定位为便宜快速的模型,被更聪明的智能体调用或用于批量数据处理、标题生成等任务,而非开发者手动选择65% 相似待验证在研究生级推理和Agent工具使用基准测试中,Opus 4基本处于领先地位,但Gemini 2.5 Pro在部分项目上与之非常接近65% 相似待验证Artificial Analysis给出Gemini 3.7 Flash的智能指数为56,比3.6 Flash高4分64% 相似待验证在AI模型能力排行榜上,Claude Opus 5以63分领跑智力榜并称霸智能体榜,Gemini 3.7 Flash以56分入榜智力第九63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/483178API
curl https://kongchang.com/api/v1/knowledge/claims/483178MCP
get_claim(id=483178)