Unverified50% confidenceFactExact time
Flash系列模型通常采用70B以下的参数规模
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
9/8/2026
First Seen
Valid until: 12/7/2026
Sources
Related Entities
Related Claims
UnverifiedFlash模型因推理速度快(单请求耗时50-200ms vs 旗舰模型500-2000ms),在相同TPM限制下可支持更高QPS71% similarUnverifiedQwen3 Next Flash的1250亿总参数与60亿激活参数之间约20:1的比例是相当激进的稀疏度设计68% similarUnverifiedDeepSeek Flash模型每秒token输出可达100多66% similarUnverified盘古2.0 Flash恰好填补了当前开源社区在27B到200B之间的空缺,此前没有一款90B左右的开源MoE模型66% similarUnverified70B量级模型的全量微调至少需要8张A100 80G显卡63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/879171API
curl https://kongchang.com/api/v1/knowledge/claims/879171MCP
get_claim(id=879171)