待验证50% 置信事实精确时间
HumanEval 由 OpenAI 发布,MBPP 由 Google 发布,两者核心任务是根据自然语言描述写独立的 Python 函数
1
来源数
50%
置信度
长期有效
时效性
2026/7/6
首次发现
来源
Claude Code深度解析:为何成为最强AI编程工具
bilibili小码学IT2026/7/2
相关事实
待验证OpenAI、Anthropic等主流AI公司均提供基于Python的官方SDK69% 相似已验证HumanEval由OpenAI提出,包含164道Python编程题,主要测试函数级别的代码生成能力67% 相似待验证SWE-bench 出现之前业界最常用的编程能力评估工具是 HumanEval(OpenAI)和 MBPP(Google)64% 相似已验证OpenAI发布了Codex App,这是一个集项目构建、多任务并行、自动化审查和语音交互于一体的智能开发环境62% 相似待验证Simon的LLM库最初定位为命令行工具与Python API,用于统一调用OpenAI、Anthropic、Google等多家模型提供商的接口62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/115224API
curl https://kongchang.com/api/v1/knowledge/claims/115224MCP
get_claim(id=115224)