[
KongchangAI
]
Feed
Entities
Podcasts
Deep Dives
Developers
About
Get CLI
中文
Benchmark
MedCalc-Bench Verified
MedCalc-Bench
专为评估大语言模型在临床计算任务上的表现而设计的基准数据集,覆盖肾功能评分、心血管风险评分、体液补充计算等多类常用医学评分工具,Verified子集经过人工核查以保证评测可重复性
Source Articles
让大模型不再算错药:临床计算的确定性求解方案
Sep 12