待验证50% 置信事实精确时间
除了bitnet-b1.58-2B-4T之外,目前没有一个从头训练的正规三值模型的先例
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/16
首次发现
有效期至:2026/10/14
来源
相关事实
待验证千问3.8 27B基于千问3.5的整套架构体系,架构层面与3.5完全一致,仅做了继续预训练和后训练(含SFT与RL强化)65% 相似待验证1-bit量化(如BitNet b1.58)将每个参数用-1、0、+1三值表示,目前主要停留在研究阶段63% 相似待验证DeepSeek-V3发布时在多项基准测试中与Claude 3.5 Sonnet持平甚至超越,训练成本据报道仅为主流闭源模型的数分之一61% 相似待验证微软的Phi-3仅3.8B参数但在多项基准测试中性能媲美早期GPT-4级别的模型60% 相似待验证训练7B参数模型的全参数微调通常需要至少4张A100(80G)显卡,而LoRA使单张RTX 4090(24G)完成7B量级模型微调成为可能57% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/533432API
curl https://kongchang.com/api/v1/knowledge/claims/533432MCP
get_claim(id=533432)