[KongchangAI]
Unverified50% confidenceFactExact time

LLM 推理请求分为 Prefill(输入)和 Decode(输出)两个阶段,Prefill 可并行读取吞吐极高,Decode 需逐字串行推理占用 GPU 时间显著更长

1
Sources
50%
Confidence
Long-term
Relevance
9/2/2026
First Seen

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/842836
API
curl https://kongchang.com/api/v1/knowledge/claims/842836
MCP
get_claim(id=842836)