Unverified50% confidenceBenchmarkExact time
在前端与视觉任务(Three.js、SVG等)中Sol仅得6至7分,而Fable 5能稳定拿到9至10分,前端仍是OpenAI的弱项
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/10/2026
First Seen
Valid until: 10/8/2026
Sources
GPT-5.6三模型深度评测:Sol、Terra、Luna实测对比分析
bilibili安得广厦千万间6787/9/2026
Related Claims
Unverified在前端与视觉任务上So仅得6到7分,而Fable 5能拿到9或10分70% similarUnverified在盲测中Sol给Opus方案打8.3分、给Fable方案打6.0分69% similarUnverified3B参数模型在SVG生成任务上存在能力天花板,量化级别的影响被基础能力不足所掩盖60% similarUnverified根据Artificial Analysis Arena的排名数据,xAI的Grok 4.6在综合能力上被认为与Sol 5.6处于同一水平60% similarUnverifiedOpenAI发布材料中未公布Sol在SWE-bench Pro的得分,该项测试目前由Fable 5领跑59% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/471352API
curl https://kongchang.com/api/v1/knowledge/claims/471352MCP
get_claim(id=471352)