待验证50% 置信事实精确时间
传统n-gram语言模型只能捕捉局部词序关系,通常仅建模3到5个词窗口内的依赖关系
1
来源数
50%
置信度
长期有效
时效性
2026/8/11
首次发现
来源
相关事实
待验证传统n-gram模型和单语训练的神经语言模型在遇到跨语言词序列时会给出极低的概率分数,导致解码器倾向于将外语词强行映射为发音相近的本语言词74% 相似待验证A core limitation of current large language models is the finite context window71% 相似待验证大语言模型以词元(token)为基本处理单位,而非以单词为单位理解语言69% 相似已验证大型语言模型通过将输入文本分割为tokens来处理语言,tokens可以是完整单词、子词片段或单个字符68% 相似待验证早期模型的上下文窗口仅有4K至8K个Token,约3000至6000个英文单词68% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/731898API
curl https://kongchang.com/api/v1/knowledge/claims/731898MCP
get_claim(id=731898)