Unverified50% confidenceBenchmarkExact time
在 Deep Study 软件工程测试中,Argon 得分 77.9%,高于 GPT-6 Astra 和 Cloud Opus 5.5(后两者约为 74%)
1
Sources
50%
Confidence
Short-term (~14 days)
Relevance
10/1/2026
First Seen
Valid until: 10/15/2026
Sources
Related Entities
Related Claims
Unverified在 Frontier Software Engineering 基准上 GPT-6 Astra 以 65.5% 领先,Opus 5.5 为 62.3%,Gemini 4 Argon 仅 55%76% similarUnverified在 DeepSWE 1.1 测试中,GPT-6.1 Sol 得 75.2%,Astra 为 74.8%,Cloud Sonnet 5.5 为 71.0%,GPT-6 Sol 最高 68.8%72% similarUnverifiedGPT-5.6编程能力在关键基准上达到91.9%,安全评测CyberGym得分85.6%,均超越竞品Nexus 566% similarUnverified在软件工程基准DeepSweep上GPT-6 Sol取得68.8%,距顶级旗舰约差1.1个百分点,成本降低约八成66% similarUnverifiedGPT-6 Astra在3D物体创建能力测试中达到95.9%的饱和度,比竞品高出10多个百分点66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/963870API
curl https://kongchang.com/api/v1/knowledge/claims/963870MCP
get_claim(id=963870)