Unverified50% confidenceFactExact time
N-gram统计语言模型通过相邻词的条件概率捕捉局部上下文,受限于固定窗口大小,无法处理长距离依赖,参数量随词汇表指数膨胀
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
Transformer学习路径为何总是起步太晚?正确顺序比材料更重要
redditr/learnmachinelearning7/11/2026
Related Claims
Unverified大语言模型的上下文窗口决定了模型在单次推理中能处理的信息量上限74% similarUnverified大语言模型在生成每个词元时,是在对词汇表中所有可能的下一个词进行概率采样,而非确定性地选择唯一答案74% similarVerified大语言模型本质上是在学习给定前文下一个词是什么的条件概率分布73% similarUnverified语言建模将一段文本的联合概率分解为每个词在其前文条件下的条件概率之积73% similarUnverified大语言模型通过自监督预训练学习token序列的条件概率分布,本质上是统计压缩模型,无法通过统计特征区分正确与错误的数学证明71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/500454API
curl https://kongchang.com/api/v1/knowledge/claims/500454MCP
get_claim(id=500454)