Unverified50% confidenceFactExact time
自回归语言模型的OOD检测比传统机器学习更困难,因为语言组合空间庞大、语义OOD与表面形式OOD不对应,且对抗者可构造统计上看似in-distribution但语义触发OOD的输入
1
Sources
50%
Confidence
Long-term
Relevance
8/21/2026
First Seen
Sources
Related Claims
Unverified语言模型输出具有概率性和语义模糊性,难以用精确断言衡量质量,这使得TDD思想迁移至提示词领域面临挑战78% similarUnverified困惑度衡量语言模型对测试文本的预测能力,数值越低表示模型越不惊讶于看到这些文本77% similarUnverified大语言模型的知识来源于海量文本数据的统计学习,擅长语言模式匹配,但对物理世界的因果关系缺乏真正的理解,这在学术界被称为'grounding problem'(接地问题)77% similarVerified大语言模型推理的瓶颈往往不在计算能力,而在于内存带宽77% similarUnverified大语言模型生成的文本困惑度(Perplexity)偏低,词汇选择过于符合概率预期,缺乏人类写作的意外性77% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/784179API
curl https://kongchang.com/api/v1/knowledge/claims/784179MCP
get_claim(id=784179)