Verified70% confidenceFactExact time
Large language models are trained on vast corpora of text data and learn to predict the probability distribution of the next word
4
Sources
70%
Confidence
Long-term
Relevance
8/2/2026
First Seen
Sources
Related Entities
Related Claims
Verified大语言模型通过在数千亿乃至数万亿个词元(Token)的文本数据上进行自监督预训练81% similarUnverified部分大型语言模型能够逐字复现热门基准中的题目与答案75% similarUnverified结构化数据到自然语言生成(Data-to-Text Generation)可借助大语言模型将传感器数据转化为拟人化语言反馈72% similarUnverified当训练数据中某些文本出现频率极高时,大语言模型可能产生记忆化(Memorization)现象,能够近乎逐字输出特定段落72% similarUnverifiedWord2Vec于2013年通过浅层神经网络的预测任务(CBOW与Skip-gram)学习词向量72% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/680398API
curl https://kongchang.com/api/v1/knowledge/claims/680398MCP
get_claim(id=680398)