待验证50% 置信事实精确时间
大语言模型编程场景的核心能力指标包括HumanEval代码生成基准、SWE-bench真实Bug修复成功率及跨文件依赖解析准确性
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
Codex额度不够用?HeyRoute接入GPT-5.5深度测评
bilibiliManCity-DeBruyne2026/7/10
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/495234API
curl https://kongchang.com/api/v1/knowledge/claims/495234MCP
get_claim(id=495234)