待验证50% 置信基准精确时间
在同一张英伟达H100显卡上,DiffusionGemma每秒可生成约1500个token,而上一代自回归模型仅能生成约300个,快了近5倍
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/8/27
首次发现
有效期至:2026/11/25
来源
涉及实体
相关事实
待验证阿里千问新一代模型参数达2.4万亿,是该系列首个突破万亿的多模态大模型,代码生成准确率据称达到94.7%,较上一代提升约11个百分点68% 相似待验证早期LLM只能处理约4000个token,当前最新模型已支持10万甚至100万token的上下文67% 相似待验证报告测出DiffusionGemma平均每步生成token数达到19.74个,而自回归方法每步只能生成1个66% 相似待验证一个千亿参数级别旗舰模型每次推断所需GPU资源可能比百亿参数模型高出10至20倍61% 相似待验证自回归生成机制下,生成长度越长累积计算量越大,生成1000个Token的耗时大约是生成100个Token的10倍61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/807335API
curl https://kongchang.com/api/v1/knowledge/claims/807335MCP
get_claim(id=807335)