[控场AI]
· 6 分钟阅读· 3,157 字

GPT-6.1 Sol价格仅五分之一,OpenAI开发者日重磅发布全解读

GPT-6.1 Sol价格仅五分之一,OpenAI开发者日重磅发布全解读

OpenAI开发者日密集更新:Sol模型主打极致性价比,Dots智能体、Agents API与插件生态加速平台化布局。

OpenAI在最新开发者日发布了多项重磅更新。GPT-6.1 Sol以接近旗舰Astra的性能、仅为其五分之一的价格(输入2美元/输出10美元每百万Token)登场,成为性价比核心卖点。全天候云端智能体Dots基于GPT-6 Astra构建,拥有持久化云端电脑,但首次演示出现卡顿。订阅体系方面,500美元Pro500套餐新增,Ultra Fast推理层级同步推出;Agents API进入预览,Codex Cloud与CLI支持多智能体协同;ChatGPT还打通Devon、Notion等16家合作伙伴并开放插件平台,周活用户突破12亿。苹果侧,快捷指令接入增强版AI模型,AppleCare裁员换AI客服计划则被无限期搁置。整体趋势是:模型价格持续下探、速度持续拉升、生态加速平台化,但智能体从演示到生产落地仍存明显差距。

OpenAI开发者日:GPT-6.1 Sol主打极致性价比

OpenAI在最新开发者日上密集释放了一系列产品更新,其中最受关注的是GPT-6.1 Sol的发布。据绿鸭AI日报整理,这款模型性能接近旗舰级的Astra,但价格仅为Astra的五分之一。

标准档定价为每百万Token输入2美元、输出10美元。OpenAI官方称,这是当前同等性能水平下性价比最高的模型。对于需要大规模调用API的开发者和企业而言,价格骤降五分之一意味着推理成本被大幅压缩,这也延续了大模型行业「性能上探、价格下探」的整体趋势。

全天候智能体Dots:能力亮眼但演示翻车

OpenAI还发布了全天候智能体Dots,它基于GPT-6 Astra构建,最大的特点是拥有自己的云端电脑。这意味着即便用户离开自己的设备,Dots仍能在云端持续执行任务,实现真正的「无人值守」自动化。

不过,这类前沿功能的稳定性仍有待打磨。在首次公开演示中,Dots在「准备音乐应用上线」的任务里突然失去响应,现场主持人只好打趣说「Dots,今天早上有点慢」。这一小插曲也从侧面反映出云端智能体在真实场景下的可靠性挑战——能力边界虽然被不断拓宽,但复杂长任务的执行稳定性依然是行业难题。

「云端电脑」这一概念在AI智能体领域有特定含义:服务商在数据中心为每个智能体实例分配一套持久化的虚拟计算环境,包括文件系统、浏览器、代码运行时等,使其能够跨会话保存状态并持续执行任务,而无需依赖用户本地设备保持在线。这与此前大多数AI助手「对话即终结」的无状态模式有根本区别。传统模式下,用户关掉浏览器标签页,任务就中断了;云端电脑模式下,智能体可以在后台持续运行数小时乃至数天,完成编译、测试、提交PR等耗时操作。OpenAI将这一基础设施能力通过Agents API开放给开发者,意味着第三方应用也可以基于相同的持久化执行环境构建自己的自动化工作流,而不必自建云端沙箱。

订阅体系重构:500美元Pro套餐登场

ChatGPT的订阅层级再度扩容。新增的每月500美元Pro500套餐,用量达到Plus的25倍,并独享速度最快的Astra Ultra Fast。同时,200美元的Pro套餐重新对新订阅用户开放。

用量上线是Plus的25倍

围绕速度,OpenAI推出了Ultra Fast服务层级:在Codex中最高可快8倍,每秒能生成300个Token;在API中最高快6倍。GPT-6 Astra的Ultra Fast已经开放API,短上下文输入每百万Token 60美元、输出300美元。高价背后是对低延迟、高吞吐场景的定向供给,适合对响应速度敏感的生产环境。

值得关注的还有阿里通义千问广告方向的动态——科文3.8 Flash(Qwen Coder)在Coder平台的限时免费活动延期,原定9月30日结束,现从10月1日起继续免费,结束时间暂未确定。调用它不消耗Credits,新老个人用户自动生效,对成本敏感的开发者是一大利好。

调用它不消耗Credits

每百万Token(Million Tokens)是大语言模型API定价的标准计量单位。一个Token大致对应英文中的0.75个单词,或中文的1至1.5个汉字,因此1百万Token约相当于75万英文单词或约66万汉字的文本量。Ultra Fast层级中GPT-6 Astra的短上下文定价——输入60美元、输出300美元每百万Token——与GPT-6.1 Sol的输入2美元、输出10美元相比高出约30倍,反映出低延迟高吞吐推理所需的专属算力资源远比常规推理昂贵。「短上下文」这一限定也值得注意:模型处理的上下文越长,所需显存和计算量越大,高速推理在长文本场景下成本更高,因此Ultra Fast目前主要针对短上下文场景提供价格保证。

开放生态:订阅打通16家伙伴,插件平台上线

OpenAI在生态开放上迈出关键一步。据其团队发帖,现在可以直接在16家以上合作伙伴的产品里使用ChatGPT订阅,包括Devon、OpenCode和Notion。用户无需应对繁琐规则,直接消耗订阅内包含的用量,用ChatGPT登录即可开始。

更进一步,ChatGPT向开发者开放了插件平台,开发者可以构建带插件扩展的原生应用,并直接在ChatGPT内发布。这一举措意在把ChatGPT打造成一个应用分发入口,而不仅仅是对话工具。

支撑这套开放战略的是庞大的用户基数——OpenAI透露,ChatGPT周活跃用户已超过12亿,ChatGPT Work和Codex每周用户超过3500万。如此规模的流量池,为插件与合作伙伴生态提供了强大的商业化基础。

Codex与Agents API:开发者工具全面升级

面向开发者的工具链同步升级。Agents API进入预览阶段,它为Dots等所有云端代理提供底层支持,还支持电脑操作,开发者可以基于它自研同类产品。

OpenAI的Agents API进入预览

全新的Codex Cloud也已上线,支持配置云端环境和上传笔记本,即使本地关机代理也会继续工作。Codex CLI迎来换新升级:新增语音对话,可直接开口下达任务并在中途引导;新增的Agents视图能把工作分配给多个智能体并统一跟踪进度;终端界面更加简洁,且所有套餐均可使用。从单智能体到多智能体协同,Codex正在向更完整的AI编程工作流演进。

Agents API的核心价值在于提供了一套标准化的「智能体运行时」抽象层。传统AI API仅处理单次请求-响应,而Agents API在此之上封装了任务状态管理、工具调用(如浏览器操控、代码执行、文件读写)、以及多智能体间的任务分发与结果汇总机制。开发者无需从零搭建这套基础设施,可以直接调用API来创建能够使用电脑、维持长期记忆并与其他智能体协作的应用。Codex CLI新增的Agents视图正是这套机制在前端的具体体现——它把复杂编程任务拆解后分配给多个并行运行的子智能体,并在统一界面中聚合进度与结果,这在工程上类似于分布式任务队列,只是调度对象从函数变成了具备推理能力的AI实例。

苹果动态:快捷指令接入增强版AI,AppleCare裁员计划搁置

苹果方面也有更新。面向iOS 27、iPadOS 27和macOS 27的快捷指令迎来改进,新增35项以上操作。最大亮点是「使用模型」指令可以调用增强版Apple智能模型,还能联网获取快捷指令里任何内容的最新信息,让自动化流程具备实时数据能力。

苹果更新支持文档

人事层面,据彭博社记者古尔曼爆料,苹果此前曾考虑裁减约5000名AppleCare售后人员,让AI智能体接管部分电话和网络售后。不过该计划目前已被无限期搁置,苹果不再考虑这样做。这一反复也说明,AI替代人工客服在大型企业落地时仍需权衡服务质量与用户体验。

小结

这一轮更新呈现出清晰的行业脉络:模型层面价格持续走低、速度持续拉高;产品层面订阅分层更加精细;生态层面OpenAI通过打通合作伙伴和开放插件平台加速平台化;工具层面则围绕多智能体协同重塑开发者体验。而Dots演示翻车与苹果裁员计划搁置,则提醒我们AI智能体从「能演示」到「能生产」之间,仍有一段路要走。

分享:

相关推荐