GPT-6双模型发布API降价50%,AI大模型集体降价潮来袭

OpenAI与Anthropic同日降价50%,AI行业全面进入成本、安全与端侧三线并进的新阶段。
过去24小时,AI行业迎来密集变局。OpenAI发布GPT-6系列Sol与Luna模型,API价格较此前再降50%;Anthropic同步上线Cloud Opus 5.5,成本降40%的同时越界尝试减少85%,两强同日降价标志着大模型竞争正式进入成本与效率深水区。安全治理层面,OpenAI引入METR、Redwood Research等第三方机构深入训练阶段评估,DeepSeek与月之暗面亦受邀在联合国安理会就AI安全发言,治理透明化与国际化趋势明显。硬件端,高通联合月之暗面在骁龙8平台跑通300亿参数离线模型,内存需求降逾50%;华为AI手表开售,苹果则因隐私顾虑搁置摄像头AI吊坠项目。能力、成本与安全的三角平衡,正在重塑整个AI产业格局。
过去24小时,AI行业迎来密集更新:OpenAI与Anthropic在同一天宣布模型升级并大幅下调成本,端侧大模型跑通300亿参数,AI硬件与安全治理同步推进。本文基于B站「明镜与点点」AI日报内容,梳理七条要闻并做延伸分析。
大模型双雄同日降价,成本战全面打响
最受关注的当属OpenAI与Anthropic的正面对决。OpenAI发布了GPT-6系列的Sol和Luna两款模型,采用与Astra同类的训练路线,API价格较此前GPT-5.6的促销价再降50%。在Automation Bench任务上,其调用成本仅为竞品Opus 5的9%,成本控制能力相当激进。
几乎同一时间,Anthropic上线Cloud Opus 5.5,能力已接近旗舰Fable 5.1,但成本下降40%,输出速度较Opus 5提升超30%。值得关注的是安全表现——新模型的越界尝试次数较前代减少85%,说明能力提升与安全对齐正在同步推进。

两家头部厂商在同一天集体降价,标志着大模型竞争已从单纯的能力比拼进入成本与效率的深水区。对开发者而言,API调用成本腰斩意味着更多应用场景变得经济可行;对行业而言,价格战可能进一步压缩中小模型厂商的生存空间。
AI安全治理提速,第三方评估与国际协作并进
安全议题在本轮更新中占据显著位置。OpenAI宣布允许第三方在训练阶段介入安全评估,评估范围覆盖训练、评估、部署全流程。对于最敏感的项目,甚至会邀请外部人员进入办公室开展合作,合作方包括METR与Redwood Research两家专注AI安全评估的机构。
这一举措打破了以往安全评估多集中在部署后阶段的惯例,将监督前移到模型训练环节,被视为AI治理透明化的重要一步。

国际层面同样有大动作。据路透社报道,DeepSeek广告受邀在联合国安理会会议上就AI安全发表讲话,本周三的会议主题为「AI与国际安全」,月之暗面亦受邀发言,OpenAI的奥尔特曼也计划出席演讲。中国AI企业登上安理会讲台,反映出AI安全已上升为全球性治理议题,中国厂商的话语权正在提升。
METR(Model Evaluation & Threat Research)与Redwood Research是目前AI安全评估领域最具代表性的独立机构。METR专注于对前沿大模型进行「自主性与危险能力」评估,核心任务是判断模型是否具备自主复制、获取资源或实施网络攻击等高危行为;Redwood Research则在对抗性鲁棒性与可解释性方向深耕多年,致力于找到让AI系统在极端输入下依然可控的技术路径。将这类机构引入训练阶段,而非仅在产品上线前做最终把关,相当于在流水线源头就嵌入外部视角,可以更早发现潜在的对齐偏差。这种「红队前置」的做法此前在军事与网络安全领域有先例,但在大模型训练中大规模推行尚属首次,业界普遍认为这将成为未来高风险AI系统开发的行业基准。
端侧大模型突破,300亿参数跑上手机
芯片与端侧AI的进展同样亮眼。高通携手月之暗面,在骁龙8端侧平台上跑通了300亿参数模型,并联合无量火及江波龙完成内存适配,内存需求较常规方案降低超50%,预填充吞吐超过330 Token/s,可实现完全离线运行。

300亿参数模型在移动端离线运行,意味着更强的本地推理能力和更好的隐私保护——数据无需上传云端即可完成处理。这一突破为端侧AI应用(如离线助手、本地文档处理)打开了新的想象空间,也标志着大模型正从云端向终端下沉。
衡量端侧大模型性能的两个核心指标值得理解:**预填充吞吐(Prefill Throughput)**指模型处理输入提示词的速度,单位为Token/s,直接影响用户感受到的「首字延迟」;内存占用则决定能否在消费级芯片上加载模型权重。通常,300亿参数模型以FP16精度存储需约60GB内存,远超手机LPDDR容量上限,因此量化压缩(如INT4/INT8)和分块加载技术是端侧部署的关键。本次方案将内存需求压缩超50%,意味着有效参数精度控制在了较激进的量化区间,同时依赖骁龙8系列NPU对稀疏运算的硬件加速,才能将预填充吞吐维持在330 Token/s以上的可用水平。这一组合拳说明端侧大模型的突破本质上是算法压缩、编译优化与芯片架构三者协同的结果,单靠任何一方都无法实现。
AI硬件冷热不均:华为智能表开售,苹果吊坠搁浅
AI硬件赛道呈现两极分化。华为Watch 6鸿蒙AI手表于今日10点08分正式开售,售价2799元起,搭载HarmonyOS及万象AI助手,并联合瑞金医院推出24小时血压评估功能。医疗健康与AI助手的结合,成为可穿戴设备差异化竞争的关键卖点。

与之形成对比的是,据彭博社消息,苹果已推迟其摄像头AI吊坠项目的研发。该项目原本设想通过持续采集视觉数据来拓展AI能力,但因隐私安全挑战而搁置。这一取舍再次印证:AI硬件的落地不仅是技术问题,如何平衡数据采集与用户隐私,正成为决定产品成败的核心变量。
总结
本轮AI行业更新呈现出清晰的三条主线:大模型进入成本竞争阶段,头部厂商以降价换市场;安全治理从企业自律走向第三方监督与国际协作;端侧AI加速落地,硬件产品在隐私红线下谨慎推进。能力、成本与安全的三角平衡,正在重塑整个AI产业的竞争格局。
相关推荐

AI编程为何离不开Git?从版本回退到AI辅助命令全解析
Git是AI编程的必备工具。本文解析Git分布式版本控制在AI编程中的价值,包括应对AI幻觉的版本回退、分支管理等核心操作,以及如何用豆包、AI输入法等工具快速生成Git命令,帮助新手零基础入门。

拒绝AI胡编:一款"说不了谎"的求职信生成器是如何炼成的
一位开发者因AI求职信工具凭空捏造其Kubernetes经验和管理经历而屡遭拒信,于是打造了CoverCraft——通过代码计算评分、GitHub提交记录背书、对抗性审查与人工审批四重机制,构建一款"无法说谎"的AI求职信生成器。本文解析其对抗AI幻觉的工程设计。
Perplexity携手美国运通:为小企业主打造即用型AI技能库
Perplexity携手美国运通:为小企业主打造即用型AI技能库
Perplexity 联合美国运通推出面向小企业卡会员的即用型 AI 技能库,内置现金流预测、营销活动生成等预构建工作流,用户无需编写提示词即可让 AI 处理日常业务任务。