Unverified50% confidenceFactExact time
Claude Opus 4.8在智能体实战跑分中拿下1890分,比上一代高出137分,甩开GPT 5.5达121分
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Claude Opus 4.8代码能力登顶,却暴露AI训练致命隐患
bilibili智视界6/23/2026
Related Claims
Unverified在SABench基准测试中,Claude Opus 4.7得分约33分,而人类高级工程师得分80-90分76% similarUnverifiedClaude Opus 4.8 reached 85.9% on the GraphWalks 256K subset (up from 76.9% for 4.7) and 68.1% on the full 1-million-token version, nearly double Opus 4.7's score of 40.3%75% similarPartially VerifiedClaude Opus 4.8在SWE-bench基准测试中得分69.2%,GPT 5.5为58.6%,Google Gemini为54.2%75% similarUnverifiedOpus 4在SWE-bench Verified上的通过率超过72%,显著领先于其他竞争模型74% similarUnverifiedClaude Opus 4.8 scored 1890 ELO on GDPVal AA, which is 137 points higher than Opus 4.7 and 121 points above GPT 5.574% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/40946API
curl https://kongchang.com/api/v1/knowledge/claims/40946MCP
get_claim(id=40946)