Unverified50% confidenceFactExact time
LLaMA 1的训练数据量为1.4T token,LLaMA 2的训练数据量为2T token
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/2/2026
First Seen
Valid until: 9/30/2026
Sources
Hyper-Connections:残差连接十年来首次重大改进
bilibili姚育平6/6/2026
Related Claims
Unverified当前主流大模型的训练数据量已达到十几T甚至六十T token71% similarUnverified训练角色一致性LoRA模型只需20-50张高质量参考图,训练约1500-3000步,在RTX 3090等消费级GPU上可在2-4小时内完成64% similarVerified2022年DeepMind发布Chinchilla论文,修正了最优训练配比,指出在给定算力预算下模型参数量与训练token数应大致保持1:20的比例63% similarUnverified该计划采用月度周期递增(Training Max每周期仅增加很小幅度),内置保守起始建议(以真实1RM的85-90%作为训练最大值),适合需要长期、低伤害风险地积累力量的中高级训练者62% similarUnverified训练过程可拆分为外循环(周/月单位,接收用户反馈)和内循环(小时/天单位,快速爬坡验证)61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/53862API
curl https://kongchang.com/api/v1/knowledge/claims/53862MCP
get_claim(id=53862)