Unverified50% confidenceOpinionExact time
业界普遍推测Flash的参数规模大约是Pro的三分之一到二分之一
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/30/2026
First Seen
Valid until: 11/28/2026
Sources
Related Entities
Related Claims
UnverifiedFlash模型每token的推理成本通常比Pro级模型低一个数量级66% similarUnverified单条推理通常只能占用GPU SM利用率的5%~15%,而合理的批次大小可将利用率提升至60%~90%65% similarUnverified推理计算占比预计将达到AI总算力的三分之二55% similarUnverified参数量在1亿以下的轻量模型经领域数据微调后可达95%以上意图分类准确率,单次推理延迟控制在5-20ms以内55% similarUnverifiedCursor Pro账号月度配额通常利用率仅为30-40%,通过池化调度可将整体利用率提升至70-80%以上54% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/824198API
curl https://kongchang.com/api/v1/knowledge/claims/824198MCP
get_claim(id=824198)