Mac Studio
Apple推出的高性能桌面电脑,搭载M系列Ultra芯片,配备大容量统一内存架构,适合本地运行大型AI模型等高负载任务
Core Facts
Timeline (last 90 days)
'一台顶八台Mac Studio'的结论是UP主基于并发数的直观类比,并未给出详细的吞吐量、延迟、功耗等量化基准测试数据
苹果Mac Studio凭借统一内存架构在单任务推理上表现不俗,但在多任务并发时与英伟达设备差距显现
一位Reddit用户在Mac Studio上本地运行Qwen模型时,模型在网页工具调用中访问了一个指向阿里云对象存储(OSS)的签名URL
整个 PNN 系统运行在作者家中的一台 Mac Studio 上
博主使用M4 Max、M5 Max和一台Mac Studio组成三机集群运行该模型
仅用Mac Studio和M4 Max两台机器时,任务超过十万token会因内存不足崩溃,加入第三台机器后解决
作者的Mac Studio被Hermes Agent推荐加载Qwen3系列的Flash Next模型
一位Reddit用户在M5 Ultra 256GB 80核 Mac Studio上运行了GLM-5.3-Flash等多个模型的实测
运行NVIDIA Nemotron 3.5 Lightning模型时,Mac mini每秒约生成38个词,Mac Studio每秒约124个词
文中使用1250亿参数的Qwen模型,文件体积达105GB,该任务因模型过大只能在Mac Studio上运行,32GB的Mac mini无法容纳
40 more timeline events
All Facts (20)
Qwen3系列编程模型约20GB加载,推理时可膨胀到35-40GB
70%Verified配备192GB统一内存的Mac Studio M4 Ultra理论上可以运行完整的70B甚至更大参数的模型
70%Verified苹果芯片采用统一内存设计,CPU、GPU与神经网络引擎共享同一物理内存池,内存带宽可达300GB/s以上
65%VerifiedLlama 3.3 70B经过4-bit量化后模型大小约为40GB,可在配备64GB内存的Mac Studio或单张48GB显存的专业GPU上运行
65%VerifiedMac Studio M5 Ultra版从5499美元起,最高512GB内存,内存带宽达到每秒1.2TB,512GB版本预计10月下旬到货
80%Verified苹果推出搭载M6芯片的新一代Mac mini
80%VerifiedMac mini M6版从899美元起,最高32GB统一内存,2026年9月22日开售
75%UnverifiedUpCtl在实际部署中采用混合云架构,Agent部署在本地Mac Studio上,Service层和Web端部署在公网云主机上
90%Partially Verified新款Mac Studio采用统一内存设计,128G内存版本国行19999元起,512G版本起步价46999元
65%UnverifiedM5 Ultra 版本的 Mac Studio 最高配备 80 核 GPU、最高 512GB 统一内存
60%UnverifiedMac Studio配备六个Thunderbolt 5端口、HDMI 2.1、10G网口,并保留全尺寸USB-A口和SDXC读卡器
60%Unverified在AmorphousDiskMark测试中M5 Ultra顺序读取达14,888MB/s、写入接近20,000MB/s,M3 Ultra读取约6500MB/s、写入2700MB/s
60%Unverified据视频引用的报道,OpenAI 采购了数万台 Mac mini 和 Mac Studio 用于强化学习,让 AI 在真机上练习操作电脑
60%UnverifiedMac Studio搭载M系列芯片,如M2 Max、M2 Ultra及后续更新版本
60%Unverified苹果Mac Studio凭借统一内存架构在单任务推理上表现不俗,但在多任务并发时与英伟达设备差距显现
50%Unverified'一台顶八台Mac Studio'的结论是UP主基于并发数的直观类比,并未给出详细的吞吐量、延迟、功耗等量化基准测试数据
50%Unverified整个 PNN 系统运行在作者家中的一台 Mac Studio 上
50%Unverified仅用Mac Studio和M4 Max两台机器时,任务超过十万token会因内存不足崩溃,加入第三台机器后解决
50%Unverified作者的Mac Studio被Hermes Agent推荐加载Qwen3系列的Flash Next模型
50%Unverified在Blender公开跑分榜中,搭载M5 Ultra的Mac Studio得分介于RTX 5090与RTX 4090之间
50%