OpenAI DevDay 25项更新:Dots常驻智能体与GPT-6.1 Sol登场

OpenAI DevDay发布25项更新,常驻智能体Dots与低成本高性能模型GPT-6.1 Sol是两大核心。
OpenAI 在最新一届 DevDay 上密集发布 25 项更新,重点落在两个方向:一是常驻智能体 Dots,它能 24 小时持续工作、连接 4000 余款应用,由旗舰模型 Astra 驱动,普通对话免费但任务执行仍计入用量额度;二是 GPT-6.1 Sol,该模型智能水平接近 Astra 但成本仅为其五分之一,缓存输入定价低至每百万 Token 0.1 美元,在多项基准测试中以极低成本逼近旗舰水准。套餐层面新增 500 美元 Pro 档,额度为 Plus 的 25 倍并独享 Ultra Fast 急速模式;开发者工具则覆盖 Codex Cloud、Agents API、Codex CLI 及 Space/Pages 等协作产品,整体呈现出 OpenAI 将 AI 能力深度嵌入开发与团队工作流的战略意图。
OpenAI 在最新一届 DevDay 上一口气发布了 25 项更新,覆盖常驻智能体、模型升级、开发者工具与协作产品等多个方向。从 B 站 AI 资讯博主的整理来看,这次发布会的两大核心是全天候工作的智能体 Dots 和成本大幅下探的新模型 GPT-6.1 Sol。本文梳理其中值得关注的要点。
Dots:全天候常驻的智能体
Dots 被定位为一个 24 小时常驻、持续为用户工作的智能体。它从用户的反馈中学习,拥有自己独立的电脑和浏览器,并能连接到 OpenAI 生态中超过 4000 款应用。驱动它的是目前 OpenAI 最强的模型 Astra。
按照官方说法,Dots 已经开始面向符合标准的用户启动首个「主 Dots」,后续用户还能创建完整的 Dots 团队进行协作。该功能覆盖 Pro、Business、Premium 和 Enterprise 计划,其中包括 100 美元档的 Pro 计划,并会进一步扩大使用范围。

关于「不消耗用量额度」的表述需要厘清。查阅 OpenAI 官网描述可知,套餐内赠送的首个 Dots 是免费的,若想添加更多则需额外付费;与 Dots 的普通对话不计入使用限额,但当你让 Dots 在 Codex 或 ChatGPT Work 中启动、管理任务时,仍会计入限额。换言之,「免费」更多是指闲聊式交互,真正的生产力任务依然要吃额度。
「常驻智能体」(Persistent Agent)是一种区别于传统对话式 AI 的新范式。传统聊天模型每次对话结束后状态即清空,而常驻智能体拥有持久化记忆,可以在后台异步执行任务,无需用户实时监督。这类设计使 AI 能够承担跨越数小时乃至数天的长周期任务,例如持续监控某个数据源、自动处理邮件队列或按计划推进多步骤项目。Dots 所谓「拥有自己独立的电脑和浏览器」,本质上是给智能体分配了一套沙盒化的计算环境,使其可以独立操作网页、运行代码,而不依赖用户的本地设备。这与 OpenAI 此前发布的「Computer Use」能力一脉相承,也是当前 AI Agent 领域的主流架构方向。
GPT-6.1 Sol:接近 Astra,成本仅 1/5
模型层面的最大看点是 GPT-6.1 Sol。它在智能水平上接近 Astra,但价格只有后者的五分之一,缓存输入成本低至每百万 Token 0.1 美元——比标准输入定价低 95%,比上一代 GPT-6.0 Sol 的缓存输入价格还低 50%。

在能力上,GPT-6.1 Sol 相较 GPT-6.0 Sol 在编程、计算机使用和复杂专业工作方面有重大升级,并在多项基准测试中逼近 GPT-6.0 Astra:在 Terminal Bench 4.0 中以极低成本超过了 Astra 和 Opus 5.5;在 Artificial Analysis 智能指数上仅比 GPT-6.0 Astra 低 1 分。同时在遵循用户意图和安全约束方面也更可靠。该模型即日起向 ChatGPT Work 和 Codex 中的 Plus、Pro、Business、Enterprise 及 EDU 用户开放。
这组数据背后的信号很明确:OpenAI 正在用「接近旗舰、价格腰斩再腰斩」的策略推动高性能模型的普及,让更多开发者能以更低成本调用接近顶级的智能。
「缓存输入(Cached Input)」定价是大模型 API 计费中的一个重要机制。当同一段前缀文本(如系统提示、长文档上下文)被反复调用时,服务商可以将其缓存在高速存储中,后续请求无需重新处理这部分内容,因此以更低价格计费。对于需要在同一上下文中进行大量推理的应用场景(如代码辅助、RAG 检索增强生成、长文档分析),缓存命中率越高,实际成本节省越显著。GPT-6.1 Sol 将缓存输入定价压至每百万 Token 0.1 美元,意味着高频调用同一上下文的开发者可以将推理成本压缩到接近边际值,对构建规模化 AI 应用的团队而言是实质性的成本利好。Terminal Bench 和 Artificial Analysis 智能指数是业内常用的第三方模型能力评测基准,前者侧重终端操作与代码执行能力,后者综合评估模型在推理、知识、指令遵循等维度的表现。
定价调整:Pro 额度与新的 500 美元套餐
发布会上关于套餐额度的说明也引发关注。200 美元 Pro 额度被明确为 Plus 的 10 倍,而现有 200 美元 Pro 用户将在一段时间内保留 20 倍乘数,并获得大量额外额度。
真正的新面孔是 500 美元 Pro 套餐,其额度为 Plus 的 25 倍。配套推出的 Ultra Fast 急速模式只能在该套餐中使用——在 Codex 中最高可达每秒 300 个 Token、8 倍 Token 吞吐,在 API 中最高 6 倍。

此外,用户现在可以直接在超过 16 个合作方产品中登录并使用自己的 ChatGPT 订阅,无繁琐限制,包含的全部用量都能直接使用,覆盖 Devin、OpenCode、Notion 等产品。这意味着 ChatGPT 订阅正在从单一入口走向跨产品的「通用算力账户」。
开发者工具与协作产品矩阵
除了模型与套餐,这次更新还铺开了一整套开发者和协作工具。
Codex Cloud 可在电脑上运行、通过手机远程操作,或从任意设备在云端运行,提供可复用的开发环境让任务快速启动,并支持团队共享配置,覆盖 Plus、Pro、Business、医疗保健版、Education 和 Enterprise。
Agents API 驱动所有云端智能体(包括 Dots)的同一技术也进入预览阶段,并支持计算机操作。全新升级的 Codex CLI 支持语音对话,可直接与 Codex 对话启动和引导任务,新增 Agents 视图能将工作分配给多个智能体并跟踪进度。

协作层面,OpenAI 推出了 Space(与 AI 和团队共同工作的空间)、Pages(面向人机协作的全新文档类型)以及 协作室 PPT(让团队与 ChatGPT 共建专业 PPT),这些功能适用于 Pro、Business 和 Enterprise 套餐。开发者侧还有 Decisions API,把模型智能集中到一组用户定义的、带有限预定义答案的问题上,实现实时决策,可用于内容分类、请求路由或选择智能体的下一步操作,即日起限量开放预览。
「Agents API」的进入预览标志着 OpenAI 正式将智能体编排能力开放给第三方开发者。此前,多智能体协作主要依赖开发者自行实现任务分发、状态管理和工具调用逻辑。Agents API 将这些基础设施标准化,开发者可以基于统一接口构建自定义的智能体团队,而无需从零搭建调度层。「Decisions API」则代表另一种思路:不追求通用推理,而是将模型能力约束在一组预定义的结构化选项中,以换取更低延迟和更可预测的输出。这种「受限推理」在内容审核、请求分类、流量路由等高吞吐场景中更具实用价值,因为这类场景对响应速度和一致性的要求往往高于对开放式创造力的需求。
小结
从这 25 项更新能看出 OpenAI 的清晰思路:以 Dots 为核心推动「常驻智能体」落地,以 GPT-6.1 Sol 大幅压低高性能模型成本,再通过 Codex、Agents API、Space/Pages 等工具把 AI 深度嵌入开发与团队协作流程。对普通用户而言,关注点在于额度与套餐的性价比变化;对开发者而言,更低的 Token 成本和更完整的智能体工具链才是真正的红利。
相关推荐

好莱坞的真正对手:免费内容的降维打击
Skydance 收购华纳和派拉蒙后高喊对标硅谷,但好莱坞真正的对手是 TikTok、Instagram 和 YouTube——它们几乎不为内容付费。本文剖析免费内容大军、硅谷版权侵权文化与 AI 训练数据争议背后的成本结构之战。

KernelAgent:多智能体自动优化GPU内核,跨硬件超越专家基线
Meta 推出的 KernelAgent 是一套多智能体 GPU 内核优化框架,能自动编写并优化内核,在 GPU、TPU、AMD 及 Meta 自研 AI 芯片等异构硬件上超越专家基线。本文解析其设计思路与应用价值。

Alexa Plus一年实测:智能家居之王,为何仍走不出家门?
The Verge播客实测Alexa Plus近一年:语音创建自动化场景体验出色,成为最强智能家居助手,但跨出家门做通用助理却屡屡碰壁。亚马逊500美元新平板欲补个人情境短板,苹果Siri AI也将入场,智能家居之争背后是技术成熟与隐私信任的深层张力。