Unverified50% confidenceBenchmarkExact time
2023年多项研究表明,GPT-4在回答医学问题时虚构参考文献的比例可高达30%-70%
1
Sources
50%
Confidence
Long-term
Relevance
8/13/2026
First Seen
Sources
Related Claims
Unverified2023年的一项研究发现 GPT-4 在生成代码文档时约有15-20%出现错误75% similarVerified即使是GPT-4这类顶级模型,在特定领域的幻觉率仍可达到15%-30%74% similarUnverified2024 年纽约大学的一项研究发现,GPT-4 生成的代码中约有 5.2% 的包引用指向不存在的软件包73% similarUnverified谷歌DeepMind的FactScore显示GPT-4在人物传记生成任务中精确事实陈述比例约为73%71% similarUnverified2023年GPT-4在USMLE三个阶段均达到60分以上及格线,部分研究报告其得分接近平均医学生水平70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/742278API
curl https://kongchang.com/api/v1/knowledge/claims/742278MCP
get_claim(id=742278)