Unverified50% confidenceFactExact time
BERTScore 等基于预训练向量的指标尝试引入语义相似度,但仍停留在句子粒度,难以追踪答案中具体事实主张是否与上下文一致
1
Sources
50%
Confidence
Long-term
Relevance
9/28/2026
First Seen
Sources
Related Entities
Related Claims
Unverified当输入存在歧义时LLM不会报错,而是沿训练数据中最高频的语义路径继续生成,用统计上最常见的答案填补需求空白68% similarUnverified研究指出聚合准确率指标会系统性地掩盖多语言事实推理中的不对称能力,是辛普森悖论的一种体现68% similarUnverified自回归模型存在暴露偏差(exposure bias)问题,训练时看到真实前缀但推理时面对自己生成的错误前缀导致误差累积67% similarUnverified采用频率感知训练调度(对稀有词元采样高于均匀采样)后,模型在最稀有词频区间上追平了参数量匹配的BERT与TinyBERT基线67% similarUnverified当测量工具存在系统性偏差时,即便统计方法再复杂,得出的结论也可能是误导性的66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/955563API
curl https://kongchang.com/api/v1/knowledge/claims/955563MCP
get_claim(id=955563)