已验证65% 置信事实精确时间
SWE-bench由普林斯顿大学团队开发,Pro版本要求模型在真实GitHub代码仓库中定位Bug并生成修复补丁
3
来源数
65%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
GPT-5.6发布:三款模型对标Claude,ChatGPT Work超级应用全解析
bilibiliAI-seeker2026/7/9
相关事实
部分验证SWE-Bench was developed by a Princeton University team and extracts tasks from real GitHub issues, requiring models to locate problems within complete codebases and generate fix patches84% 相似已验证SWE-bench由普林斯顿大学提出,包含来自真实GitHub仓库的2294个软件工程问题84% 相似已验证SWE-bench要求模型在真实GitHub仓库中定位并修复实际Issue84% 相似已验证SWE-bench 由普林斯顿大学研究团队创建,从 GitHub 真实开源项目中抽取 issue,要求模型生成能通过测试用例的补丁84% 相似待验证SWE-bench Verified 由普林斯顿大学研究团队开发,从 GitHub 真实仓库抽取需修复的 Issue83% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/501555API
curl https://kongchang.com/api/v1/knowledge/claims/501555MCP
get_claim(id=501555)