待验证50% 置信事实精确时间
SHADOW-50M是一个从零训练、消化了450亿token的完整语言模型,实际拥有44M参数,模型体积为19.8MB
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
待验证SHADOW-50M在笔记本CPU上以约1900 tok/s运行,内存占用仅41MB67% 相似待验证SHADOW不使用训练得到的embedding层,而是用固定的512-bit指纹表示73880个token的词表,冻结表仅4.7MB,可随时添加新词而无需重新训练66% 相似待验证一个7B参数模型在FP16格式下仅模型权重就需要约14GB显存,训练总显存需求可能膨胀到50-80GB65% 相似待验证千问3.5-9B包含约90亿个可训练参数,经4-bit量化后模型文件大小可压缩至约5-6GB65% 相似待验证27B参数的Q8_0模型加上vLLM的KV Cache和运行时开销,单个推理服务需要近50GB内存空间63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/922665API
curl https://kongchang.com/api/v1/knowledge/claims/922665MCP
get_claim(id=922665)