待验证50% 置信事实精确时间
Beam的强化学习阶段使用1500块GB300连跑四周,生成超过一亿条rollout,最长上下文到256K
1
来源数
50%
置信度
长期有效
时效性
2026/10/8
首次发现
来源
涉及实体
相关事实
待验证Beam预训练使用6144块英伟达GB300 NVL72,用时不到4周,消耗23.8万亿个token76% 相似待验证测试者用双4090(48GB显存)工作站运行20.7B稠密模型,每秒生成27.6个Token,仅比矮星略快,但参数量小10倍以上68% 相似待验证开发者公布在RTX 3050 Laptop(4GB)上微调Llama-3.1-8B的实测结果为训练速度119.6 tok/s,峰值显存3.32 GB66% 相似待验证程序根据显存推荐上下文长度:8G显存推荐32K上下文,24G显存可支持128K65% 相似待验证以70B的BF16模型为例,产生一个token需读入约140GB权重,打满H100的3.35TB/s显存带宽时每token延迟至少42毫秒,理论TPS上限约24 token/秒64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/987287API
curl https://kongchang.com/api/v1/knowledge/claims/987287MCP
get_claim(id=987287)