Unverified50% confidenceFactExact time
当训练数据中某些文本出现频率极高时,大语言模型可能产生记忆化(Memorization)现象,能够近乎逐字输出特定段落
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
纽约时报指控OpenAI隐匿证据,ChatGPT版权诉讼再升级
rss7/9/2026
Related Claims
Verified研究表明大语言模型在处理长文本时存在显著的「中间遗忘」(Lost in the Middle)现象,对输入文本开头和结尾的信息记忆较好,但对中间部分的信息关注度明显下降80% similarVerified大语言模型通过在数千亿乃至数万亿个词元(Token)的文本数据上进行自监督预训练79% similarUnverified大语言模型存在两个天然短板:知识截止于训练时间无法获取最新信息,以及只能生成文本无法直接执行操作74% similarUnverified大语言模型可以在秒级时间内完成同义替换、句式重组、语气调整等文本改写操作,使改写后的文本轻松规避基于余弦相似度或编辑距离的传统文本检测工具74% similarUnverifiedLarge language models suffer from 'attention decay' when generating long text, causing adherence to earlier instructions to decrease as context length increases73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/502987API
curl https://kongchang.com/api/v1/knowledge/claims/502987MCP
get_claim(id=502987)