Unverified50% confidenceBenchmarkExact time
在盲测中Sol给Opus方案打8.3分、给Fable方案打6.0分
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/23/2026
First Seen
Valid until: 11/21/2026
Sources
Related Entities
Related Claims
Unverified在前端与视觉任务(Three.js、SVG等)中Sol仅得6至7分,而Fable 5能稳定拿到9至10分,前端仍是OpenAI的弱项69% similarUnverified在ARC-AGI-3上Sol Max达到接近8%,而Opus和Gemini均低于1%67% similarUnverified在Artificial Analysis的Omniscience幻觉指标上,GPT-5.6 Sol Max高达89%,高于Claude Fable的55%和GLM 5.2的28%66% similarUnverifiedOpus 5在AI Omniscience测试拿了31分,避免瞎编的能力优于Opus 4.864% similarUnverifiedSol 在编程智能体指数全推理模式下拿到 80 分,刷新 SOTA,比 Faber-5 高 2.8 分64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/788652API
curl https://kongchang.com/api/v1/knowledge/claims/788652MCP
get_claim(id=788652)