待验证50% 置信基准精确时间
研究者训练的2900万参数编码器对985条陈述的流行度加权跨折AUC仅为0.486,与语料库先验无法区分
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
待验证在演示数据集上训练15轮后,文本分类模型准确率达到99%,模型总参数11万(Attention 1.6万,FFN 3.3万,其余为Embedding)67% 相似待验证蒸馏使用600个prompt训练(500训练/100验证),表征余弦相似度达0.9959,语义校正余弦相似度0.9836,在alpha=0.10时混合条件相对于教师桥接余弦相似度达0.99995866% 相似待验证在20多万行的代码库中,真正活跃的可能只有2万行,其余大量是历史遗留或已废弃的逻辑66% 相似待验证手工编写的 22 计算器库在其支持的 440 个病例上完全精确,但对其余病例选择弃权,整体覆盖率仅 40.0%66% 相似待验证在LongMemEval基准测试中,20个chunk时BM25与嵌入方案收敛于约95%准确率66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/921814API
curl https://kongchang.com/api/v1/knowledge/claims/921814MCP
get_claim(id=921814)