Unverified50% confidenceFactExact time
传统n-gram语言模型只能捕捉局部词序关系,通常仅建模3到5个词窗口内的依赖关系
1
Sources
50%
Confidence
Long-term
Relevance
8/11/2026
First Seen
Sources
Related Claims
Unverified传统n-gram模型和单语训练的神经语言模型在遇到跨语言词序列时会给出极低的概率分数,导致解码器倾向于将外语词强行映射为发音相近的本语言词74% similarUnverifiedA core limitation of current large language models is the finite context window71% similarUnverified大语言模型以词元(token)为基本处理单位,而非以单词为单位理解语言69% similarVerified大型语言模型通过将输入文本分割为tokens来处理语言,tokens可以是完整单词、子词片段或单个字符68% similarUnverified早期模型的上下文窗口仅有4K至8K个Token,约3000至6000个英文单词68% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/731898API
curl https://kongchang.com/api/v1/knowledge/claims/731898MCP
get_claim(id=731898)