Unverified60% confidenceFactTime unknown
LLM的记忆依赖于上下文窗口,即模型在单次推理时能够处理的最大Token数量
2
Sources
60%
Confidence
Long-term
Relevance
6/1/2026
First Seen
Sources
吴恩达新课解读:Agent记忆工程从入门到实战
bilibili吴恩达Agents
Related Entities
Related Claims
UnverifiedLLM本质上是无状态的推理引擎,每次调用模型时所有记忆都必须以文本形式塞入上下文窗口80% similarUnverified大语言模型的上下文窗口决定了模型在单次推理中能处理的信息量上限77% similarUnverified上下文复用与内存管理是控制LLM推理成本的关键杠杆76% similarUnverifiedLLM自回归解码阶段每生成一个token都需从显存加载全量模型权重,批量较小时形成内存墙76% similarUnverified大模型推理阶段是memory-bound(内存带宽受限),每生成一个Token需从显存读取整个模型权重,计算强度极低75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/17754API
curl https://kongchang.com/api/v1/knowledge/claims/17754MCP
get_claim(id=17754)