待验证75% 置信事实时间未知
GPT-4等大模型在Spider等基准测试上的零样本或少样本SQL生成准确率已超过80%
1
来源数
75%
置信度
长期有效
时效性
2026/6/2
首次发现
来源
吴恩达新课:构建数据库Agent智能体全解析
bilibiliAgent吴恩达
涉及实体
相关事实
待验证在Spider基准上,早期单模型方案准确率约为70%,GPT-4等大模型将其提升到80%以上,多智能体协作策略的系统已能达到85%甚至更高的执行准确率79% 相似待验证NL2SQL 技术在 Spider 等基准测试上已达到80%以上的准确率,但在多表 JOIN 和子查询等复杂操作中准确率显著下降76% 相似待验证在 Spider、BIRD 等主流 Text-to-SQL 评测中顶级模型准确率已超过 85%74% 相似待验证O4-mini在GPQA博士级问答评测中准确率超过80%74% 相似待验证On the Spider benchmark, the accuracy of state-of-the-art models rose from under 20% in 2018 to over 80%68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/36479API
curl https://kongchang.com/api/v1/knowledge/claims/36479MCP
get_claim(id=36479)