Unverified50% confidenceFactExact time
词袋模型将文本拆解为词的集合,忽略语序,只统计每个词出现的频率或权重
1
Sources
50%
Confidence
Long-term
Relevance
9/29/2026
First Seen
Sources
Related Entities
Related Claims
UnverifiedUnigram 模型由 SentencePiece 库实现,从大词表出发逐步剔除对整体似然贡献最小的子词来缩减词表75% similarVerified大模型处理文本以Token(词元)为最小处理单元,由分词器完成切分73% similarUnverified词汇-韵律单元化与分块方法仅对连续的词单元进行池化处理,以在文本和语音两种模态中保留事件的身份和量级73% similarUnverified大语言模型通过反向传播算法将文本统计规律编码进参数中,不以传统方式存储原始数据,但高频文本可能产生记忆化现象并近乎逐字输出73% similarUnverified大语言模型在进行文本摘要时,其取舍标准基于统计概率和语义相关性,而非法律上的重要性判断71% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/958803API
curl https://kongchang.com/api/v1/knowledge/claims/958803MCP
get_claim(id=958803)