苹果M6与M5 Ultra芯片发布:2nm工艺首发桌面,本地运行千亿参数大模型

苹果同步推出首颗2nm芯片M6与四芯片融合M5 Ultra,将本地千亿参数大模型推理推向桌面。
苹果在最新发布会上推出M6与M5 Ultra两颗芯片,并更新Mac Mini与Mac Studio产品线。M6是苹果首颗2纳米工艺芯片,率先搭载桌面产品而非iPhone,CPU多核性能比M5快1.2倍,AI算力较M1提升8倍以上。M5 Ultra则是首颗四芯片融合处理器,通过下一代UltraFusion将两颗M5 Max连接,最高支持512GB统一内存、1.2TB/s带宽,AI算力较M3 Ultra高出4倍,使单台Mac Studio足以离线运行量化后的千亿参数大模型。苹果将Mac Mini定位为"常年开机的智能体计算设备",并为Mac Studio提供Thunderbolt 5集群扩展能力。内存涨价导致顶配发货推迟、部分机型遭限购,折射出AI硬件需求与供应链之间的现实张力。
苹果在最新发布会上同时推出M6与M5 Ultra两颗芯片,并更新了Mac Mini和Mac Studio两条产品线。这次发布最引人注目的两个信号是:M6成为苹果首颗采用2纳米工艺的芯片,而M5 Ultra则是苹果史上最强的M系列处理器,最高配的Mac Studio足以在本地完整运行千亿级参数大模型。四款机型今日开启预购,9月22日发货,部分顶配还遭遇了限购。
M6芯片:2nm工艺首发桌面,主打能效与本地AI
值得玩味的是,苹果并没有把首颗2纳米芯片留给下一代iPhone,而是率先交给了桌面产品线。这一决策本身就传递出苹果对本地AI计算的重视——桌面平台拥有更充裕的功耗与散热空间,能够充分释放先进制程的性能潜力。
M6基于2纳米工艺打造,晶体管密度比上一代大幅提升。CPU升级为12核(4个性能核+6个能效核,另有超级核心配置),比M5多出2个核心,官方宣称单核性能全球最快,多核性能比M5快1.2倍。GPU同样为12核,比M5多2个核,每核搭载一个神经网络加速器,AI峰值算力比M5提升接近30%,相比M1更是高出8倍以上。神经网络引擎升级为双16核(共32核)设计,峰值算力达到上一代的2倍。

M6最高支持32GB统一内存,带宽170GB/s,比M5提升约10%。对比旧款M4版Mac Mini,AI性能快4倍、图形性能快2倍、CPU快约40%。这样的代际提升幅度,说明2nm工艺带来的红利相当可观。
Mac Mini搭载M6:常年开机的智能体设备
Mac Mini依然维持12.7厘米见方的紧凑机身,分为M6版和M5 Pro版两个版本。M6版起价899美元,配16GB内存加256GB存储,比M4版贵了100美元;M5 Pro版起价1699美元,最高18核CPU、20核GPU、64GB内存、307GB/s带宽,并配备Thunderbolt 5。两个版本都标配Wi-Fi 7、蓝牙、2.5G以太网,出厂系统为macOS 27。

苹果在Mac Mini的定位中特别提到一条——适合作为常年开机的智能体计算设备。这暗示苹果正在将Mac Mini推向本地AI推理服务器的角色,而非单纯的日常办公机。
M5 Ultra:苹果首颗四芯片融合处理器
M5 Ultra是苹果第一颗采用四芯片融合的处理器。由于M5 Max本身已是双芯片封装,苹果通过下一代UltraFusion接口将两颗M5 Max连接起来,共计4个裸片,裸片间带宽超过4.4TB/s,系统将其视作一颗统一处理器来调度。
在核心配置上,CPU最高达到36核(含12个超级核心、24个性能核),GPU最高80核,每个核都带有神经网络加速器。统一内存最高512GB,带宽达1.2TB/s,比M3 Ultra高50%,是M5 Max的2倍。整机AI峰值算力比M3 Ultra高出4倍以上。

512GB统一内存的意义在于——一颗处理器的Mac Studio就能把千亿级参数的大模型整个装进内存运行,无需联网、不按Token计费。这对于注重数据隐私、追求推理成本可控的开发者和企业而言,是极具吸引力的选项。
Mac Studio定价与集群能力
Mac Studio分为M5 Max版和M5 Ultra版。M5 Max版起价2499美元,最高40核GPU、128GB内存;M5 Ultra版起价5499美元,30核CPU、64核GPU、96GB内存、1TB存储起步。两款均配备Wi-Fi 7、蓝牙6和Thunderbolt 5。
更进一步,多台Mac Studio还可以通过Thunderbolt 5组成集群,进行分布式AI推理,最高提效3倍。这意味着苹果正在为本地大模型部署构建可扩展的硬件方案。
业内反应与三个关键信号
专注苹果设备本地大模型项目的EXO Labs创始人Alex Cheema在发布当天就拿到了M6 Mac Mini。而Tim Cook的官宣推文则强调新Mac Mini"机身小、性能强,从日常办公到各种AI任务都能胜任"。M5 Ultra的配文更为直接——每位客户限购两台,并预告"这批货会很快卖光"。

综合来看,这次发布传递出三点关键信息:
第一,工艺策略。 苹果把量产2nm芯片的首发给了桌面产品,而非下一代iPhone,凸显其对桌面AI计算场景的战略押注。
第二,本地AI的边界正在扩展。 M5 Ultra算力比M3 Ultra高4倍以上,官方演示场景是本地模型软件对接仿真工具,全程离线运行。这标志着高端个人工作站正逐步具备运行前沿AI模型的能力。
第三,成本与供货压力。 内存涨价直接反映在售价与发货时间上——M5 Ultra的512GB顶配因内存涨价发货推迟到10月底,而限购两台的举措则说明当前需求高度集中,现货优先。
总结:本地AI与云端AI的博弈进入新阶段
从M6到M5 Ultra,苹果这次发布的核心逻辑清晰可见:以2nm先进制程与超大统一内存为杠杆,把本地AI推理能力做到桌面级设备的极致。当一台Mac Studio就能离线运行千亿参数模型时,本地AI与云端AI的成本、隐私博弈将进入新阶段。而内存涨价带来的售价与供货波动,也提醒我们——AI硬件的普及仍受制于底层供应链的现实约束。
相关推荐

Vercel AI SDK 更新:@ai-sdk/xai 4.0.58 批处理与图像生成改进
Vercel AI SDK 发布 @ai-sdk/xai 4.0.58 版本更新,新增批处理图像生成支持,修复批处理请求类型校验及 DeepSeek 推理流问题,并同步升级 provider 相关依赖。

Litelm:给LiteLLM瘦身,轻量级LLM调用网关方案
Litelm 是一个主打轻量化的 LiteLLM 替代方案,去掉冗余功能,保留统一的多模型 LLM 调用接口。本文分析其定位、适用场景与选型权衡。

浏览器扩展过滤AI生成文章:一场信息质量的自救实验
Hacker News上一个过滤LLM生成文章的浏览器扩展引发关注。本文解析该工具的检测思路、面临的误判与对抗挑战,以及AI内容泛滥背景下用户主动筛选信息的趋势。