Unverified50% confidenceFactExact time
目前能在手机端流畅运行的模型参数量通常在30亿至70亿级别,与云端数千亿参数的旗舰模型存在数量级差距
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/8/2026
First Seen
Valid until: 11/6/2026
Sources
Related Claims
Unverified部分iPhone搭载了一款拥有200亿参数的本地模型,采用稀疏架构,任意时刻仅有10亿至40亿参数处于激活状态70% similarUnverified根据DeepMind在2022年提出的Chinchilla缩放定律,一个700亿参数的模型需要约1.4万亿token才能达到计算最优67% similarUnverified一个千亿参数级别旗舰模型每次推断所需GPU资源可能比百亿参数模型高出10至20倍65% similarUnverifiedKimi 2.5每次前向传播只计算约300亿参数,尽管总参数量达1万亿65% similarUnverified1000亿参数的模型处理单次推理请求需约80GB显存,百亿参数级别模型仅需约20GB65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/707102API
curl https://kongchang.com/api/v1/knowledge/claims/707102MCP
get_claim(id=707102)