[控场AI]
产品Ascend 950PR

昇腾950PR

华为昇腾系列AI推理加速卡,配备128GB显存,支持MXFP4/MXFP8等低精度推理格式,面向大模型推理部署场景

时间轴 (近 90 天)

9月28日

华为昇腾950PR在单卡配置下成功运行了裁剪版的DeepSeek V4-Flash模型,解码峰值达到208 TPS

待验证50%
9月28日

昇腾950PR配备128GB显存

待验证50%
9月28日

该实测的相关代码已经开源

待验证50%
9月28日

约1.6M超长上下文配合128并发时,吞吐可达约3700 tokens/s(聚合)

待验证50%
9月28日

UP主用npu-top工具搭配Pin Agent让本地模型自主完成对950PR的适配,在开启加速后达到约6倍速度,模型约6分钟内完成所有适配任务

待验证50%
9月28日

用950PR跑更高规格模型的速度暂时不及Pro7000平台,且尚未进行深度优化

待验证50%
9月28日

这些测试数据来自单一来源的初步测试,属于个人短期试用环境(数百小时的950PR使用时长),并非标准化benchmark

待验证50%

全部知识事实 (7)

来源文章