[控场AI]
论文

arXiv:2609.15995

发布于arXiv的研究论文,系统评估十种AI偏见审计工具在十个前沿模型上的检测能力与排名一致性,发现审计工具能有效检测偏见但无法可靠排名模型

时间轴 (近 90 天)

9月16日

一篇发布在arXiv上的研究(arXiv:2609.15995)搭建了统一推理网关,让十种外在审计工具在十个前沿模型组成的共享面板上跑同一套评测

待验证50%

全部知识事实 (1)

来源文章