Unverified50% confidenceFactExact time
SmoLLM基础模型训练使用了来自FineWeb-Edu数据集的约25亿token
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
不到350元训练亿参数模型:SmoLLM从零构建全记录
redditr/learnmachinelearning7/12/2026
Related Claims
Unverified智谱GLM-5.3基于743B(7430亿参数)基座进行后训练,主打编程与智能体两大核心场景70% similarUnverified开源模型LLaMA 2使用了2万亿token训练数据67% similarUnverified可利用大模型基于领域文档自动生成合成训练数据来构造问答对,通常需要数千至数万对训练样本才能取得显著效果64% similarUnverifiedRSC基于英伟达GPU构建,设计目标是支持万亿参数级别的模型训练64% similarUnverifiedMeta开源的Llama系列通过优化训练效率实现了在消费级显卡上运行70亿至700亿参数模型63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/502357API
curl https://kongchang.com/api/v1/knowledge/claims/502357MCP
get_claim(id=502357)