待验证70% 置信事实精确时间
一篇arXiv研究(arXiv:2609.26945v1)提出了一个句级评测基准,检验大模型识别法律解释准则的能力
2
来源数
70%
置信度
长期有效
时效性
2026/9/24
首次发现
来源
涉及实体
相关事实
待验证arXiv研究(arXiv:2609.27064v1)将自动化事实核查系统的联合分数拆解为答案质量和证据检索两个贡献来源79% 相似已验证一篇发表于arXiv的研究提出利用超图中的支配性质来完成单文档的抽取式摘要74% 相似待验证一项来自arXiv的研究提出了一种测试时优化方法,通过移除输入中未被提及的概念来提高LLM解释的完整性和可靠性73% 相似待验证一篇发布在arXiv上的研究(arXiv:2609.15995)搭建了统一推理网关,让十种外在审计工具在十个前沿模型组成的共享面板上跑同一套评测68% 相似待验证arXiv 上一篇论文提出了名为 CLIC(Code Learning for Identification and Comparison)的可视化分析方法,用于刻画不同 LLM 的编程行为差异67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/946192API
curl https://kongchang.com/api/v1/knowledge/claims/946192MCP
get_claim(id=946192)