待验证60% 置信事实时间未知
人类在ARC-AGI测试上的平均得分约为85%,而顶尖AI模型长期徘徊在30%-60%区间
2
来源数
60%
置信度
中期 (~90 天)
时效性
2026/5/31
首次发现
有效期至:2026/8/29
来源
Claude 4.5 vs Gemini 3 Pro:编程能力全面对决
bilibiliClaudeEvangelist
涉及实体
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/4050API
curl https://kongchang.com/api/v1/knowledge/claims/4050MCP
get_claim(id=4050)