Partially Verified70% confidenceFactTime unknown
大模型本质上是无状态的,每次推理时模型只能看到当前输入的Token序列,没有持久化的记忆存储
4
Sources
70%
Confidence
Long-term
Relevance
5/31/2026
First Seen
Sources
AI编程Token消耗太快?5个实用策略帮你省下80%费用
bilibili张朝阳讲编程
Related Entities
Related Claims
Unverified大模型是无状态的,每次API调用对模型来说都是一次全新的推理过程,完全依赖messages列表来回忆之前发生的事情79% similarUnverified大模型推理阶段是memory-bound(内存带宽受限),每生成一个Token需从显存读取整个模型权重,计算强度极低78% similarUnverified传统大模型天然是无状态的,每次推理都是独立的前向传播过程,没有持久化的外部记忆,也没有与环境交互的接口76% similarUnverified大语言模型是无状态的文本预测系统,每次推理调用仅接收当前输入的Token序列,不存储跨请求的持久化状态75% similarPartially VerifiedLLM每次推理是无状态的,受上下文窗口有限性限制,本身没有持久记忆75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/9866API
curl https://kongchang.com/api/v1/knowledge/claims/9866MCP
get_claim(id=9866)