Unverified50% confidenceEventExact time
字节跳动Seed团队计划训练超过5万亿参数的基座大模型,目前处于早期论证阶段,坚持原生预训练而拒绝蒸馏路线
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/30/2026
First Seen
Valid until: 11/28/2026
Sources
Related Entities
Related Claims
Unverified在指令微调阶段,如果训练数据包含大量遵循MECE结构的案例,模型会习得先搭框架再填细节的输出范式69% similarUnverified该项目的模型训练板块整理了从预训练、微调(SFT/RLHF/DPO)到高效推理部署的全链路资料67% similarUnverified若训练数据完全由正样本构成,模型会倾向于对任何输入都强行调用工具,产生幻觉式调用67% similarVerified微调是在通用预训练模型基础上用特定领域数据进行二次训练,使模型能将领域知识内化为参数,推理时无需额外检索步骤,延迟更低66% similarUnverified大量国产模型以通义千问(Qwen)等开源模型为基座,在此基础上完成预训练和微调后对外发布66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/823706API
curl https://kongchang.com/api/v1/knowledge/claims/823706MCP
get_claim(id=823706)