[控场AI]
产品Apple M5 Ultra

M5 Ultra

苹果首颗采用四芯片融合架构的处理器,通过UltraFusion接口连接两颗M5 Max,最高支持512GB统一内存和1.2TB/s带宽,可在本地运行千亿参数大模型

核心事实

时间轴 (近 90 天)

9月25日

若256GB配置下GPU已是瓶颈,将内存翻倍到512GB不会提升GPU算力,加载更大模型反而推理速度更慢

待验证50%
9月25日

M5 Ultra的80核GPU是Apple Silicon消费级最高配置,但与NVIDIA H100/H200等数据中心级GPU相比浮点算力仍有数量级差距

待验证50%
9月25日

该用户认为相对于256GB的大内存容量,M5 Ultra的GPU算力显得不足

待验证50%
9月25日

一位Reddit用户在M5 Ultra 256GB 80核 Mac Studio上运行了GLM-5.3-Flash等多个模型的实测

待验证50%
9月24日

在Blender公开跑分榜中,搭载M5 Ultra的Mac Studio得分介于RTX 5090与RTX 4090之间

待验证50%
9月23日

M5 Ultra的FP8、FP4浮点算力与BF16算力一致,进入FP4精度时与Spark算力差距明显缩小

待验证50%
9月23日

UP主小蛋糕的最终决定是不买M5 Ultra、保留Spark,主要因为要做AI实验且CUDA平台库拿来即用

待验证50%
9月23日

M5 Ultra在BF16算力上仅相当于半个DGX Spark

待验证50%
9月23日

M5 Ultra内存容量是RTX Pro 6000的五倍多,但内存带宽只有其约三分之二

待验证50%
9月23日

若带宽达到2.4TB/s,100GB模型理论速度上限可达24 token/s,60GB模型40 token/s,35GB模型接近69 token/s

待验证60%

还有 40 条时间轴事件

全部知识事实 (20)

已验证

M5 Ultra整机AI峰值算力比M3 Ultra高出4倍以上

65%
已验证

苹果M2 Ultra的UMA内存总线带宽已达800GB/s

65%
已验证

M5 Ultra很可能采用UltraFusion双芯片互联封装技术,将两颗M5 Max级别芯片组合为一个逻辑整体

65%
已验证

Mac Studio M5 Ultra版从5499美元起,最高512GB内存,内存带宽达到每秒1.2TB,512GB版本预计10月下旬到货

80%
已验证

Mac mini M6版从899美元起,最高32GB统一内存,2026年9月22日开售

75%
已验证

苹果正在规划的M7 Ultra芯片,最高可搭载高达1.5TB的统一内存

75%
部分验证

M5 Ultra的UltraFusion晶片间带宽从M3 Ultra的约2.5TB/s提升至4.4TB/s,连接密度提升6倍

70%
部分验证

M5为每一个GPU核心内置了专用于矩阵乘法的神经加速器(Neural Accelerator)

65%
部分验证

GPU重度负载下M3 Ultra功耗约100W,M5 Ultra飙到400W以上

65%
部分验证

新款Mac Studio采用统一内存设计,128G内存版本国行19999元起,512G版本起步价46999元

65%
部分验证

统一内存架构使CPU、GPU与NPU共享同一块内存池,避免数据在处理单元间反复搬运的开销

65%
待验证

在M5 Ultra的1.2TB/s带宽下,100GB量化模型理论速度约12 token/s,200GB约6 token/s,300GB约4 token/s

60%
待验证

若带宽达到2.4TB/s,100GB模型理论速度上限可达24 token/s,60GB模型40 token/s,35GB模型接近69 token/s

60%
待验证

M5 Ultra 版本的 Mac Studio 最高配备 80 核 GPU、最高 512GB 统一内存

60%
待验证

M5 Ultra相比M3 Ultra在Geekbench单核提升约33.5%,多核提升约32.5%

60%
待验证

在700亿参数模型的首token时间测试中,M3 Ultra耗时31.6秒,M5 Ultra仅7.7秒,达到约4.1倍,接近苹果宣称的4.3倍

60%
待验证

在能装入32GB显存的中小模型上,RTX 5090领先(Gemma 4 12B约45%,GPT-OSS 20B超75%),但Qwen 3 27B从Q4的47%领先降到Q8的23%

60%
待验证

M5 Ultra多核性能跑出近乎9950X3D两倍的分数,并在Cinebench 2026中保持同样优势

60%
待验证

在700亿参数DeepSeek R1蒸馏模型上,因模型溢出RTX 5090的32GB显存,M5 Ultra比5090快20倍以上

60%
待验证

在AmorphousDiskMark测试中M5 Ultra顺序读取达14,888MB/s、写入接近20,000MB/s,M3 Ultra读取约6500MB/s、写入2700MB/s

60%

来源文章