[控场AI]
产品NVIDIA RTX Pro 6000

RTX Pro 6000

NVIDIA面向专业工作站推出的高端GPU,配备96GB显存,适用于大模型本地推理等高显存需求任务

核心事实

时间轴 (近 90 天)

10月3日

Nick Erickson(AutoGluon 作者)用 TabPFN 3.5,一行代码、一块 RTX Pro 6000 GPU、一分钟计算,在历史 Kaggle Auto Challenge 中拿到第一名的解

待验证50%
9月26日

RTX Pro 6000官方将价格翻倍到16000美元,亚马逊上普遍要价19999美元

待验证50%
9月23日

M5 Ultra内存容量是RTX Pro 6000的五倍多,但内存带宽只有其约三分之二

待验证50%
9月23日

ECC纠错内存能自动检测并修正单比特内存错误,游戏卡如RTX 5090通常不带ECC,而RTX Pro 6000、NVIDIA A系列、H系列专业卡均标配ECC

待验证50%
9月23日

若工作八成是本地LLM、超大模型、Coding Agent且在意安静功耗维护成本,推荐M5 Ultra尤其256GB以上版本;若工作是生图、生视频、LoRA、3D、训练则推荐RTX Pro 6000

待验证50%
9月23日

96GB显存能同时装下两个模型不代表两个任务能同时满速运行,因为GPU算力资源被共享竞争

待验证50%
9月16日

在 RTX Pro 6000(96GB 显存)上,官方 FP8 版配合内置 MTP 投机解码可跑到约 120 tokens/秒,质量与 16-bit 几乎无差异

待验证50%
9月15日

全新DGX Spark的市场售价大致在5000至6000美元之间,且价格随需求上升持续攀升

已过期60%
9月11日

社区横向对比数据:M2 Ultra约20 token/秒,M3 Ultra 512GB为39.8 token/秒,单张B200为119.7 token/秒,8张RTX Pro 6000约204 token/秒,改装48GB显存RTX 4090定制后端367 token/秒,双H200约375 token/秒

待验证50%
7月16日

NVIDIA RTX 5090基于Blackwell架构,配备32GB GDDR7显存,理论FP16算力超过100 TFLOPS

已验证70%

还有 1 条时间轴事件

全部知识事实 (11)

已验证

在RTX 5080 16GB显卡上使用LTX 2.3生成一段8秒视频片段的平均耗时约为2至3分钟

80%
已验证

NVIDIA RTX 5090基于Blackwell架构,配备32GB GDDR7显存,理论FP16算力超过100 TFLOPS

70%
已验证

NVIDIA RTX 4090拥有24GB GDDR6X显存

65%
待验证

RTX Pro 6000官方将价格翻倍到16000美元,亚马逊上普遍要价19999美元

50%
待验证

M5 Ultra内存容量是RTX Pro 6000的五倍多,但内存带宽只有其约三分之二

50%
待验证

ECC纠错内存能自动检测并修正单比特内存错误,游戏卡如RTX 5090通常不带ECC,而RTX Pro 6000、NVIDIA A系列、H系列专业卡均标配ECC

50%
待验证

若工作八成是本地LLM、超大模型、Coding Agent且在意安静功耗维护成本,推荐M5 Ultra尤其256GB以上版本;若工作是生图、生视频、LoRA、3D、训练则推荐RTX Pro 6000

50%
待验证

96GB显存能同时装下两个模型不代表两个任务能同时满速运行,因为GPU算力资源被共享竞争

50%
待验证

在 RTX Pro 6000(96GB 显存)上,官方 FP8 版配合内置 MTP 投机解码可跑到约 120 tokens/秒,质量与 16-bit 几乎无差异

50%
待验证

社区横向对比数据:M2 Ultra约20 token/秒,M3 Ultra 512GB为39.8 token/秒,单张B200为119.7 token/秒,8张RTX Pro 6000约204 token/秒,改装48GB显存RTX 4090定制后端367 token/秒,双H200约375 token/秒

50%
待验证

Nick Erickson(AutoGluon 作者)用 TabPFN 3.5,一行代码、一块 RTX Pro 6000 GPU、一分钟计算,在历史 Kaggle Auto Challenge 中拿到第一名的解

50%

来源文章