[KongchangAI]
Benchmark

Frontier SWE

前沿软件工程基准测试,考察AI模型在高复杂度、开放式工程问题上的边界能力,侧重前沿和开放性工程挑战

Timeline (last 90 days)

Oct 3

在4个智能体编码测试中,Argon赢了两个,Frontier SWE和Terminal Bench两个测试中垫底

Unverified50%

All Facts (1)

Source Articles