Unverified60% confidenceFactTime unknown
人类在ARC-AGI测试上的平均得分约为85%,而顶尖AI模型长期徘徊在30%-60%区间
2
Sources
60%
Confidence
Medium-term (~90 days)
Relevance
5/31/2026
First Seen
Valid until: 8/29/2026
Sources
Claude 4.5 vs Gemini 3 Pro:编程能力全面对决
bilibiliClaudeEvangelist
Related Entities
Related Claims
UnverifiedARC-AGI-1 在2024年之前,最先进的AI系统正确率长期徘徊在30%左右,远低于人类的85%以上79% similarUnverifiedARC-AGI-2由AI安全研究员François Chollet设计,早期GPT-4在该测试上得分不足10%,人类平均得分约85%78% similarUnverifiedAI意图识别准确率一般在85%-95%之间72% similarUnverifiedGAIA题目对人类来说相对简单,人类平均正确率约92%,但对顶级AI模型极具挑战性69% similarUnverifiedICIR是平均IC除以其波动,类似夏普比率逻辑,ICIR高于0.5通常被认为值得进一步研究67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/4050API
curl https://kongchang.com/api/v1/knowledge/claims/4050MCP
get_claim(id=4050)