RTX Pro 6000
NVIDIA面向专业工作站推出的高端GPU,配备96GB显存,适用于大模型本地推理等高显存需求任务
核心事实
时间轴 (近 90 天)
Nick Erickson(AutoGluon 作者)用 TabPFN 3.5,一行代码、一块 RTX Pro 6000 GPU、一分钟计算,在历史 Kaggle Auto Challenge 中拿到第一名的解
RTX Pro 6000官方将价格翻倍到16000美元,亚马逊上普遍要价19999美元
M5 Ultra内存容量是RTX Pro 6000的五倍多,但内存带宽只有其约三分之二
ECC纠错内存能自动检测并修正单比特内存错误,游戏卡如RTX 5090通常不带ECC,而RTX Pro 6000、NVIDIA A系列、H系列专业卡均标配ECC
若工作八成是本地LLM、超大模型、Coding Agent且在意安静功耗维护成本,推荐M5 Ultra尤其256GB以上版本;若工作是生图、生视频、LoRA、3D、训练则推荐RTX Pro 6000
96GB显存能同时装下两个模型不代表两个任务能同时满速运行,因为GPU算力资源被共享竞争
在 RTX Pro 6000(96GB 显存)上,官方 FP8 版配合内置 MTP 投机解码可跑到约 120 tokens/秒,质量与 16-bit 几乎无差异
全新DGX Spark的市场售价大致在5000至6000美元之间,且价格随需求上升持续攀升
社区横向对比数据:M2 Ultra约20 token/秒,M3 Ultra 512GB为39.8 token/秒,单张B200为119.7 token/秒,8张RTX Pro 6000约204 token/秒,改装48GB显存RTX 4090定制后端367 token/秒,双H200约375 token/秒
NVIDIA RTX 5090基于Blackwell架构,配备32GB GDDR7显存,理论FP16算力超过100 TFLOPS
还有 1 条时间轴事件
全部知识事实 (11)
在RTX 5080 16GB显卡上使用LTX 2.3生成一段8秒视频片段的平均耗时约为2至3分钟
80%已验证NVIDIA RTX 5090基于Blackwell架构,配备32GB GDDR7显存,理论FP16算力超过100 TFLOPS
70%已验证NVIDIA RTX 4090拥有24GB GDDR6X显存
65%待验证RTX Pro 6000官方将价格翻倍到16000美元,亚马逊上普遍要价19999美元
50%待验证M5 Ultra内存容量是RTX Pro 6000的五倍多,但内存带宽只有其约三分之二
50%待验证ECC纠错内存能自动检测并修正单比特内存错误,游戏卡如RTX 5090通常不带ECC,而RTX Pro 6000、NVIDIA A系列、H系列专业卡均标配ECC
50%待验证若工作八成是本地LLM、超大模型、Coding Agent且在意安静功耗维护成本,推荐M5 Ultra尤其256GB以上版本;若工作是生图、生视频、LoRA、3D、训练则推荐RTX Pro 6000
50%待验证96GB显存能同时装下两个模型不代表两个任务能同时满速运行,因为GPU算力资源被共享竞争
50%待验证在 RTX Pro 6000(96GB 显存)上,官方 FP8 版配合内置 MTP 投机解码可跑到约 120 tokens/秒,质量与 16-bit 几乎无差异
50%待验证社区横向对比数据:M2 Ultra约20 token/秒,M3 Ultra 512GB为39.8 token/秒,单张B200为119.7 token/秒,8张RTX Pro 6000约204 token/秒,改装48GB显存RTX 4090定制后端367 token/秒,双H200约375 token/秒
50%待验证Nick Erickson(AutoGluon 作者)用 TabPFN 3.5,一行代码、一块 RTX Pro 6000 GPU、一分钟计算,在历史 Kaggle Auto Challenge 中拿到第一名的解
50%