RTX 5090
NVIDIA面向消费级市场推出的旗舰级显卡,采用Blackwell架构,拥有强大的显存与计算能力,是当前消费级GPU性能天花板,广泛用于游戏及本地AI推理与训练
核心事实
时间轴 (近 90 天)
运行Qwen 3(27B)无优化基线token解码速度:RTX 5090约75、RTX 4090约46、RTX 3090约40、M5 Max 31.4、DGX Spark 12-17、Ryzen AI Max 11.5 tokens/s
模型哪怕一小部分溢出到系统内存,速度会大幅下降;实验显示同一小模型在RTX 5090显存跑151 tokens/s,放进系统内存只剩8 tokens/s
RTX 5090的技术特性与受管制的数据中心级芯片(如NVIDIA A100、H100)高度重叠
美国零售商Micro Center要求购买RTX 5090显卡的顾客填写包括无出口声明在内的额外文件
显卡走私存在零售端化整为零和大规模集装箱运输两种模式,且同时存在
RTX 5090搭载Blackwell架构GPU,具备极高的FP8/FP16浮点算力,理论上可用于大规模AI模型训练与推理
这款EPYC处理器的内存带宽据称达到NVIDIA RTX 5090的91%
测试者使用标准ComfyUI工作流,配置为ref2va int8 pruned基础模型、1.2MP分辨率、20 steps,硬件为单张RTX 5090
生成一段结果耗时约26分钟,但测试者同时在打游戏可能拖慢了速度
整套工作流跑在一张RTX 5090显卡上
还有 40 条时间轴事件
全部知识事实 (20)
RTX 5090拥有32GB显存
80%已验证RTX 5090是2025年发布的消费级旗舰显卡,拥有32GB GDDR7显存
75%已验证RTX 5080配备16GB GDDR7显存
65%待验证移动端RTX 5090采用完整的GB203核心,拥有超过10,000个CUDA核心和16GB GDDR7显存,理论算力接近上一代桌面端RTX 4090
80%待验证GPT-OSS 20B在RTX 3090上可达约40 Token/s的生成速度,在RTX 5090上能达到200 Token/s
75%待验证在能装入32GB显存的中小模型上,RTX 5090领先(Gemma 4 12B约45%,GPT-OSS 20B超75%),但Qwen 3 27B从Q4的47%领先降到Q8的23%
60%待验证RTX 5090单卡近期价格从5000美元飙升到接近9000美元
60%待验证在700亿参数DeepSeek R1蒸馏模型上,因模型溢出RTX 5090的32GB显存,M5 Ultra比5090快20倍以上
60%待验证Fast H3 工作流的主力测试平台为 RTX 5090 搭配 128GB 内存的高配环境
60%待验证模型哪怕一小部分溢出到系统内存,速度会大幅下降;实验显示同一小模型在RTX 5090显存跑151 tokens/s,放进系统内存只剩8 tokens/s
50%待验证运行Qwen 3(27B)无优化基线token解码速度:RTX 5090约75、RTX 4090约46、RTX 3090约40、M5 Max 31.4、DGX Spark 12-17、Ryzen AI Max 11.5 tokens/s
50%待验证RTX 5090的技术特性与受管制的数据中心级芯片(如NVIDIA A100、H100)高度重叠
50%待验证显卡走私存在零售端化整为零和大规模集装箱运输两种模式,且同时存在
50%待验证RTX 5090搭载Blackwell架构GPU,具备极高的FP8/FP16浮点算力,理论上可用于大规模AI模型训练与推理
50%待验证这款EPYC处理器的内存带宽据称达到NVIDIA RTX 5090的91%
50%待验证测试者使用标准ComfyUI工作流,配置为ref2va int8 pruned基础模型、1.2MP分辨率、20 steps,硬件为单张RTX 5090
50%待验证生成一段结果耗时约26分钟,但测试者同时在打游戏可能拖慢了速度
50%待验证整套工作流跑在一张RTX 5090显卡上
50%待验证RTX 5090国际市场价格在9月13号飙升到4525美元
50%待验证RTX 5090英伟达发布时官方定价1999美元
50%