Unverified50% confidenceBenchmarkExact time
在ELE测试中等推理强度下,Sol的成本约为Faber-5的1/4,Terra和Luna成本仅约1/16且得分仍超过Faber-5
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/24/2026
First Seen
Valid until: 10/22/2026
Sources
GPT-5.6三模型实测对比:Sol/Terra/Luna选哪个?
bilibili麦冬AI实验室7/11/2026
Related Claims
Unverified在 Frontier Code 准确率与成本基准测试中,低档位花费约 5 美元可达约 11% 得分,而 Opus 4.8 Max 花费约 11 美元才拿到相同得分69% similarUnverifiedExploitBench测试中Sol约76%略逊于Fable 5的78%,但Sol仅消耗约12-13万Token而Fable 5用约35万Token65% similarUnverifiedSol、Terra、Luna三个名字代表能力档位而非代次编号,Sol为旗舰最强,Terra面向日常高频工作,Luna主打性价比62% similarUnverified基准测试结果显示,Sol和Sol Ultra在大多数领域优于竞争对手Misos 5,Tara优于Fable 562% similarUnverifiedOpus 5 在 Low Effort 下的通过率约为 60%,超过了 Opus 4.8 在 Max 级别下的 59%,后者单任务成本高达 13 美元60% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/611087API
curl https://kongchang.com/api/v1/knowledge/claims/611087MCP
get_claim(id=611087)