待验证50% 置信事实精确时间
千问3.8 27B基于千问3.5的整套架构体系,架构层面与3.5完全一致,仅做了继续预训练和后训练(含SFT与RL强化)
1
来源数
50%
置信度
长期有效
时效性
2026/8/18
首次发现
来源
相关事实
待验证除了bitnet-b1.58-2B-4T之外,目前没有一个从头训练的正规三值模型的先例65% 相似待验证在27B混合架构、4B稠密模型、36B MoE三类模型上以8k上下文测试,Prefill阶段性能无变化,Decode阶段打补丁后快约1.4%64% 相似待验证Corpus 3.6 27B是开源社区基于阿里千问3.6(Qwen-3.6)进行后训练得到的优化版本,继承了千问3.6的256K长上下文能力64% 相似待验证训练7B参数模型的全参数微调通常需要至少4张A100(80G)显卡,而LoRA使单张RTX 4090(24G)完成7B量级模型微调成为可能63% 相似待验证一个rank=4的LoRA文件对于SD1.5模型约只有3-6MB,LoRA设计使训练参数量减少95%以上61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/768402API
curl https://kongchang.com/api/v1/knowledge/claims/768402MCP
get_claim(id=768402)