Unverified50% confidenceFactExact time
服务降级(Throttling)可能表现为响应速度变慢、自动切换至能力较弱的模型版本或减少上下文长度
1
Sources
50%
Confidence
Long-term
Relevance
9/11/2026
First Seen
Sources
Related Entities
Related Claims
Unverified推理模型存在降智现象,高峰期服务端可能动态降低单次请求的计算资源导致输出质量下降76% similarUnverified性能漂移是指模型输出质量随时间缓慢退化的现象,可能来自模型提供商静默更新、上下文数据分布变化以及RAG系统知识库内容更新75% similarUnverified当某个模型响应异常缓慢时切换到其他可用模型可能有效,因为瓶颈可能只出现在特定服务商的链路上75% similarUnverified减少服务跳转数量是降低延迟与缩小故障面的直接手段73% similarUnverified减少输出Token可以提升模型响应速度,因为模型生成更少的文字73% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/903854API
curl https://kongchang.com/api/v1/knowledge/claims/903854MCP
get_claim(id=903854)