[控场AI]
· 4 分钟阅读· 2,343 字

OpenAI DevDay 2026 平淡收场?三大新品盘点与吐槽

OpenAI DevDay 2026 平淡收场?三大新品盘点与吐槽

OpenAI DevDay 2026发布GPT 6.1-Sol、Dots与Decisions API,整体反响平淡,难敌竞品Opus 5.5的声势。

OpenAI DevDay 2026被普遍评价为缺乏亮点。三项核心发布中,GPT 6.1-Sol主打性价比,官方称智能水平"接近6A"但售价仅五分之一,并支持8倍加速,然而"接近"的措辞已预示其难以超越竞品Opus 5.5,且高速模式疑需500美元高阶会员才可解锁;Dots是类似Meta Muse的云端Agent托管服务,形态上并无明显创新;Decisions API主打端到端毫秒级低延迟决策,应用场景尚待验证。在竞品强势的背景下,此次发布会未能给市场带来预期中的"大招",用户情绪整体偏向观望,等待第三方实测数据成为判断新品价值的关键。

一场被寄予厚望却略显平淡的发布会

OpenAI DevDay 2026 落下帷幕,不少关注者给出的评价颇为直接——毫无波澜。在此之前,市场对这场发布会的期待值其实相当高,主要原因在于 OpenAI 近期的一系列操作并不太得人心。

据 B 站 UP 主的现场盘点,6Sol 和 6Luna 系列模型的表现没能达到用户预期,好不容易安排了一次重制,还专门挑在临近重制日的时间点。更让订阅用户不满的是,此前爆出的消息称,其订阅额度要从 20 倍缩减到 10 倍,直接砍半。加上竞品 Opus 5.5 近期风头正盛,外界普遍以为 OpenAI 会在 DevDay 上憋出一个大招予以回应。

不太符合大家预期

结果整场看下来,最“激动人心”的环节竟然是压轴时刻——Tibo 从观众席里拿着蓝色按钮按了一下,给现场所有人发了一张重制卡。除此之外,发布会的信息密度确实偏低。

三大发布内容逐一拆解

这次 DevDay 主要围绕三件事展开,我们逐一来看。

一共有几件事情

GPT 6.1-Sol:性价比路线的新尝试

第一个重点是 GPT 6.1-Sol 的发布。Tibo 宣称它具备接近 6A 的智能水平,但价格只有六A的五分之一,与 6S 保持在同一价位区间。同时它还支持此前仅在 A 系列上开放的超快模式,可实现 8 倍加速。

不过 UP 主对这款模型的实际表现持保留态度。理由很朴素:OpenAI 官方自己都只说“接近 6A”,那大概率就追不上目前呼声很高的 Opus 5.5。此外,据其了解,8 倍加速这项能力可能需要冲值 500 美元档位的会员才能解锁,这就让性价比的吸引力打了折扣。这一部分观点属于单一来源的推测,实际性能仍有待后续实测验证。

只是接近6A

Dots:平台托管型 Agent 服务

第二个发布是 OpenAI 的 Dots。UP 主将其理解为类似 Meta 旗下 Muse 的产品形态,而 Muse 近期也相当火热,风格上与年初的 OpenCloud 有些接近。

它与本地容器方案(如“龙虾”)的核心区别在于运行环境:龙虾是用用户自己的本地电脑作为容器,而 Dots 和 Muse 都由平台提供服务器,为每个用户分配一个实例,Agent 直接在云端运行。从产品逻辑上看,这是把 Agent 的运行负担从本地迁移到云端的托管模式。

每个人发配一个

不过 UP 主坦言,这个方向在他看来并没有太多新鲜感,因此暂时没有深入研究的动力。

云端托管型 Agent 服务代表了一种将 AI 代理运行环境完全外包给平台的架构思路。与本地部署方案相比,云端实例模式的优势在于用户无需承担本地计算资源的消耗与维护成本,Agent 可以持续运行而不依赖用户设备的开机状态;劣势则在于数据隐私风险更高,且平台可随时调整服务条款、额度或定价。Meta 的 Muse 走的是类似路径,通过为用户分配独立云端沙箱,使 Agent 能够调用浏览器、文件系统等工具完成复杂任务。这一赛道目前竞争已相当激烈,各大平台的差异化主要体现在实例性能、持久化存储能力、与外部服务的集成深度,以及对 Agent 行为的监控与回滚机制上。

Decisions API:低延迟决策模型

第三个是 Decisions API。UP 主将其类比为前两周颇受关注的某决策模型(Gel)。Tibo 称这套 API 能让模型完成端到端决策,耗时低于几百毫秒。

低延迟决策听起来抽象,但落地场景其实很直观——UP 主打趣说,估计过两天就会有人拿它来在游戏里“几分钟秒杀”高难度关卡(比如《我的世界》里的墨影龙),感兴趣的可以期待一下实测效果。

端到端低延迟决策 API 针对的是传统大语言模型在实时场景下的核心瓶颈:推理延迟过高。常规 LLM 完成一次推理通常需要数秒,对于需要毫秒级响应的场景——如游戏 AI、实时交易风控、自动驾驶辅助决策——几乎不可用。Decisions API 所宣称的"低于几百毫秒"意味着在模型架构或推理路径上做了针对性优化,可能涉及更小的专用模型、蒸馏技术、或对推理链路的大幅裁剪。类似思路此前已在金融领域的低延迟推理模型(如 Groq 的硬件加速方案)中有所体现。值得注意的是,低延迟往往以牺牲一定的推理深度和准确率为代价,因此该 API 更适合决策规则相对明确、容错空间较大的场景,而非需要复杂多步推理的任务。

观望情绪浓厚,实测才是关键

综合来看,这场 DevDay 的三项发布——GPT 6.1-Sol、Dots、Decisions API——都算不上颠覆性突破。GPT 6.1-Sol 走的是压低价格、提升速度的性价比路线,但性能天花板被官方口径“接近 6A”提前锁死;Dots 是云端 Agent 托管服务,形态上与竞品高度相似;Decisions API 主打低延迟决策,实用价值需要具体场景检验。

在竞品 Opus 5.5 强势的背景下,这样的发布节奏难免让期待“大招”的用户感到落差。对普通用户而言,与其急于下结论,不如等待更多第三方实测数据出炉——尤其是 GPT 6.1-Sol 与 6S、5.6S 之间的横向对比,以及 8 倍加速在实际会员门槛下的可用性。这些才是决定这几款新品含金量的关键指标。

分享:

相关推荐