已验证70% 置信事实精确时间
Claude 3.5 Sonnet支持200K token上下文,GPT-4 Turbo支持100K token上下文
4
来源数
70%
置信度
中期 (~90 天)
时效性
2026/7/9
首次发现
有效期至:2026/10/7
来源
Vibe Coding能力边界解析:AI工程化编程实战指南
bilibili图灵学院诸葛老师2026/7/8
相关事实
待验证Claude Sonnet 4.6与GPT-5.1 Codex在SWE-Bench Verified上的解决率差距仅为3.3个百分点70% 相似待验证Claude Sonnet 4.6生成的代码量是Gemini 3.1 Pro High的两倍多(627,000行 vs 307,000行)68% 相似待验证在当前编程能力排名中,Claude Opus 4.7位居第一梯队,Claude Sonnet 4.6位居第二梯队,GPT系列和Gemini系列位居第四梯队68% 相似待验证在智能体计算机使用基准中,Opus 4.8 的 high 设置与 Sonnet 5 的 max 设置表现相当,但 Sonnet 5 消耗更多 token68% 相似待验证Claude Sonnet 4.5在SWE-Bench上的得分为77.2分67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/346764API
curl https://kongchang.com/api/v1/knowledge/claims/346764MCP
get_claim(id=346764)