Unverified50% confidenceFactExact time
千问3.8 27B基于千问3.5的整套架构体系,架构层面与3.5完全一致,仅做了继续预训练和后训练(含SFT与RL强化)
1
Sources
50%
Confidence
Long-term
Relevance
8/18/2026
First Seen
Sources
Related Claims
Unverified除了bitnet-b1.58-2B-4T之外,目前没有一个从头训练的正规三值模型的先例65% similarUnverified在27B混合架构、4B稠密模型、36B MoE三类模型上以8k上下文测试,Prefill阶段性能无变化,Decode阶段打补丁后快约1.4%64% similarUnverifiedCorpus 3.6 27B是开源社区基于阿里千问3.6(Qwen-3.6)进行后训练得到的优化版本,继承了千问3.6的256K长上下文能力64% similarUnverified训练7B参数模型的全参数微调通常需要至少4张A100(80G)显卡,而LoRA使单张RTX 4090(24G)完成7B量级模型微调成为可能63% similarUnverified一个rank=4的LoRA文件对于SD1.5模型约只有3-6MB,LoRA设计使训练参数量减少95%以上61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/768402API
curl https://kongchang.com/api/v1/knowledge/claims/768402MCP
get_claim(id=768402)