待验证50% 置信事实精确时间
SHADOW不使用训练得到的embedding层,而是用固定的512-bit指纹表示73880个token的词表,冻结表仅4.7MB,可随时添加新词而无需重新训练
1
来源数
50%
置信度
长期有效
时效性
2026/9/15
首次发现
来源
涉及实体
相关事实
待验证SHADOW将注意力状态以1-bit精度写到磁盘,每token占288字节,索引每token仅22字节,查询约1微秒定位记录,注意力状态约0.03ms回灌进模型,不用向量数据库或embedding模型66% 相似待验证SHADOW-50M是一个从零训练、消化了450亿token的完整语言模型,实际拥有44M参数,模型体积为19.8MB66% 相似待验证Unsloth 通过 4-bit/8-bit 量化感知训练与动态激活卸载技术,可将 7B 模型的微调显存需求压缩至约 4–6 GB60% 相似待验证千问3.5-9B包含约90亿个可训练参数,经4-bit量化后模型文件大小可压缩至约5-6GB59% 相似待验证内存紧张的老旧设备(4GB内存)不建议用Chrome作主力:其多进程架构每个标签独立占用内存,10个标签轻松吃掉2GB+,应选Edge(带休眠)或轻量级Firefox58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/922669API
curl https://kongchang.com/api/v1/knowledge/claims/922669MCP
get_claim(id=922669)