Unverified50% confidenceFactExact time
Reflection称Beam在推理类测试上与GLM成绩相当,但推理算力省三到四倍,该倍数按激活参数和生成token数估算,非实测成本
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
10/8/2026
First Seen
Valid until: 1/6/2027
Sources
Related Entities
Related Claims
Verified混合专家架构(MoE)在推理时仅激活约10%-30%的总参数量,显著降低单次推理的FLOPs和显存占用63% similarUnverifiedGLM 5.3 单次推理的实际计算量可能相当于一个 70B–150B 的稠密模型62% similarVerified斯坦福大学2023年研究表明,GPT-4V等多模态模型解析嵌套条件逻辑流程图时,准确率比等效文字描述低约15-25个百分点62% similarUnverified对同一测试用例执行多次调用统计成功比例得到通过率,比二元的通过/失败判断更能反映模型真实表现62% similarUnverifiedGLM系列744B模型每个token只激活约40B参数,约占总量5.4%61% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/987293API
curl https://kongchang.com/api/v1/knowledge/claims/987293MCP
get_claim(id=987293)