产品Ascend 950PR
昇腾950PR
华为昇腾系列AI推理加速卡,配备128GB显存,支持MXFP4/MXFP8等低精度推理格式,面向大模型推理部署场景
时间轴 (近 90 天)
9月28日
华为昇腾950PR在单卡配置下成功运行了裁剪版的DeepSeek V4-Flash模型,解码峰值达到208 TPS
待验证50%
9月28日
昇腾950PR配备128GB显存
待验证50%
9月28日
该实测的相关代码已经开源
待验证50%
9月28日
约1.6M超长上下文配合128并发时,吞吐可达约3700 tokens/s(聚合)
待验证50%
9月28日
UP主用npu-top工具搭配Pin Agent让本地模型自主完成对950PR的适配,在开启加速后达到约6倍速度,模型约6分钟内完成所有适配任务
待验证50%
9月28日
用950PR跑更高规格模型的速度暂时不及Pro7000平台,且尚未进行深度优化
待验证50%
9月28日
这些测试数据来自单一来源的初步测试,属于个人短期试用环境(数百小时的950PR使用时长),并非标准化benchmark
待验证50%
全部知识事实 (7)
待验证
约1.6M超长上下文配合128并发时,吞吐可达约3700 tokens/s(聚合)
50%待验证昇腾950PR配备128GB显存
50%待验证用950PR跑更高规格模型的速度暂时不及Pro7000平台,且尚未进行深度优化
50%待验证这些测试数据来自单一来源的初步测试,属于个人短期试用环境(数百小时的950PR使用时长),并非标准化benchmark
50%待验证华为昇腾950PR在单卡配置下成功运行了裁剪版的DeepSeek V4-Flash模型,解码峰值达到208 TPS
50%待验证该实测的相关代码已经开源
50%待验证UP主用npu-top工具搭配Pin Agent让本地模型自主完成对950PR的适配,在开启加速后达到约6倍速度,模型约6分钟内完成所有适配任务
50%