[控场AI]
· 9 分钟阅读· 4,696 字

OpenAI DevDay重磅发布:Dots智能体、GPT 6.1 Sol与云端Codex全解析

OpenAI DevDay重磅发布:Dots智能体、GPT 6.1 Sol与云端Codex全解析

OpenAI DevDay发布常驻智能体Dots、协作空间Space及全系模型与开发者工具更新,全面推进AI从对话工具向自主工作伙伴转型。

OpenAI在最新DevDay上以密集的产品矩阵宣告AI范式转移:核心产品Dots是由顶级对齐模型Astra驱动的常驻智能体,可跨4000+应用自主执行任务、写代码、调日程,同时将控制权留给用户。配套的ChatGPT Space则为人与智能体提供共享协作画布。模型层面,GPT 6.1 Sol以五分之一价格提供接近旗舰的智能,UltraFast实现每秒300 token的极速响应,Decisions API则面向毫秒级决策场景。开发者工具方面,Codex全面上云,Agents API打包智能体所需核心组件,Codex Security Cloud主动发现并修复漏洞。生态层面,Sign in with ChatGPT和Plugin Extensions为开发者打开商业化通路。Sam Altman以"新文艺复兴"定调整体愿景,强调AI应让人获得更多掌控而非成为机器的附庸。

OpenAI在最新一届DevDay上一口气发布了大量新产品,从常驻智能体Dots到更便宜快速的模型GPT 6.1 Sol,再到全面上云的Codex。CEO Sam Altman将这次更新称为"我们最好的一届DevDay",其核心指向一个清晰的方向:让AI从被动应答的工具,转变为主动干活的团队成员。

Dots:一个真正"有你在"的常驻智能体

这次发布会的绝对主角是Dots。OpenAI将其定义为"能力极强、始终在线的智能体",灵感来自电影中那种无所不能的AI助手。与只能帮你订餐、买机票的传统虚拟助手不同,Dots的野心大得多——它了解你的工作方式、你关心的事情,无需事无巨细地下达指令就能主动完成任务。

在演示中,用户为自己的Dot起名"Alfred",它能自动处理网站上线、更新董事会PPT、检查代码回归、协调婚礼供应商更换,甚至发现财务评审与女儿演出撞期后主动帮忙改期。这种"第二大脑"式的体验,被OpenAI形容为"终于找回了自己的注意力"。

You can add them to Slack.

技术层面,Dots由OpenAI最对齐的模型Astra驱动,拥有云端专属电脑和浏览器,能自主写代码、跑测试并提交PR供审阅。它接入超过4000个应用,可复用你已连接的所有插件。更关键的是控制权始终在用户手中——你可以设定应用和电脑的边界,为每个操作自定义指令,把责任委托到你觉得放心的程度。

未来Dots还将支持短信和电话交互:你可以给Dot发消息、接收更新,甚至直接打电话讨论决策。Dots和后文的Space今天起向所有ChatGPT Pro、Business Premium和Enterprise用户开放,且不占用常规使用额度。

Astra是OpenAI目前对齐程度最高的旗舰模型,其命名来自希腊语"星星",强调长期规划与安全性的平衡。"对齐"(Alignment)在AI语境中指模型行为与人类意图和价值观保持一致的程度——对齐度越高,模型越不容易做出用户不希望的操作,这对于被授予主动执行权限的智能体尤为关键。Dots以Astra为核心,意味着它在自主采取行动(如提交代码、更改日历、联系供应商)时,会优先遵从用户设定的边界与授权范围,而非随意扩展权限。这也解释了为何OpenAI在演示中反复强调"控制权始终在用户手中"——对于一个可以真正"帮你干活"的智能体,对齐机制是安全使用的根本保障。

ChatGPT Space:人与智能体协同的新空间

单个Dot再强,团队协作仍需要一个共享空间。OpenAI指出,几乎所有生产力软件都不是为"AI与人协作"设计的,Space正是为此而来。

Space以页面为起点,你可以在其中写计划、做研究、生成图像和数据。Dots能直接在页面里与你并肩工作——你可以像对待资深工程师那样,在评论中@某个Dot让它介入任务,也可以给页面设定持续性指令,比如"每天检查API平台的Slack频道并更新发现"。

产品团队成员Holly通过虚构音乐应用"Blossom"演示了完整工作流:她的Dot"Dotty"能主动抓取过夜反馈、发现设计改版并推送、通过语音随时同步进展、在Space中把数据变成动态图表,还能在Slack里接手被转发的任务线程。OpenAI坦言一个意外发现——员工开始把Dots当作真正的"委派对象",从一开始就把它们拉进群聊,工程师们甚至让Dots每天自动修复数十个bug。

面向企业用户,OpenAI还预览了"专家Dots"(Specialist Dots),相当于公司层面配置的虚拟同事,可承担会计、市场、法务等密集型工作,并将改进经验在全公司共享。OpenAI正与微软合作,把专家Dots接入Agent 365。

模型更新:GPT 6.1 Sol、UltraFast与Decisions API

继几周前发布Astra后,用户最强烈的两个诉求是——更便宜、更快。OpenAI这次给出了直接回应。

GPT 6.1 Sol主打成本与能力的平衡,以约五分之一的价格提供接近Astra水平的智能,缓存输入成本更是标准输入的"95%折扣",让智能体复用上下文、迭代方案、处理长任务时更经济。OpenAI将其定位为开发者的"日常主力"。

You can see how much faster this builds.

UltraFast则追求极致速度,达到标准速度的8倍、约每秒300 token,代价是6倍价格。发布会用"生成火箭"的并排演示直观展示了速度差距。此外还推出了Decisions API,通过给Luna模型预定义选项集,让模型在几分之一秒内响应,适用于请求路由、图像分类、决定智能体下一步等场景,同时保留图像理解、多语言和安全防护能力。

订阅层面,OpenAI推出拥有最高额度的Pro500(使用量是Plus的25倍并可访问UltraFast),同时重新开放Pro200订阅。

Token是大型语言模型处理文本的基本单位,大致对应英文中3-4个字符或中文中1-2个汉字。"每秒300 token"是衡量模型输出速度的标准指标,意味着UltraFast每秒可生成约150-200个中文字符,足以支撑实时语音交互、代码流式补全等对延迟极度敏感的场景。缓存输入(Cached Input)则是另一项成本优化机制:当智能体在长任务中需要反复引用相同的上下文(如代码库、长文档)时,系统可将已处理过的token存入缓存,后续调用直接复用,避免重复计算,从而大幅降低费用。GPT 6.1 Sol对缓存输入提供95%折扣,使得需要多轮迭代的智能体工作流在经济上真正可行。

AI研究实习生:模型开始自我加速

Tejal分享了一个颇具分量的进展:一年前Sam和Jakob曾预言"一年内会出现首个AI研究实习生",当时外界普遍不信,如今这一目标已达成——系统能独立完成需要熟练研究员耗费大量时间的明确研究任务。

数据显示,今年1月模型在15分钟内的短任务上表现尚可,但对耗时一天以上的任务几乎全部失败;到7月,配合UltraFast,模型已能在无人干预下完成超过三分之一的"一天级"研究任务。这些模型还反过来优化了计算机使用的harness,带来超过2倍的延迟改善,并提升了不安全场景下的拒绝率与对齐性。OpenAI表示,Astra类模型已帮助解决上百个悬置数十年的数学问题,并在抗生素研发、古语言研究、新能源等领域发挥作用。

开发者工具全面升级:Codex上云与Agents API

面向开发者的核心是"把OpenAI内部同款工具交给你"。驱动Codex和Dots的Codex harness已开源,可查看底层实现。

重头戏是Codex全面上云——你可以在手机上启动任务,切换到浏览器或桌面无缝接续,无需保持笔记本开机。基于云端harness,OpenAI还推出Codex Security Cloud,持续发现漏洞并准备经验证的修复方案,支持自动去重和定时扫描。

All right.

新的Agents API(公测中)打包了harness、托管、记忆、多智能体控制等核心组件,并把计算机使用能力带给智能体。OpenAI还与AWS深化合作,推出由OpenAI驱动的Bedrock托管智能体;同时预览OpenAI Private Intelligence,通过ZDR私有安全处理和私有推理,在不存储用户内容的前提下提供前沿模型能力。此外,Responses API过去一年增长100倍,仍保持99%以上可靠性,首token时间缩短45%,工具调用提速逾30%。

Roman的现场演示尤为亮眼:用UltraFast实时改造3D场景、通过语音在CLI中构建应用、让Astra自主学会玩游戏、用"app shot"跨屏幕尺寸审计应用,甚至连线Hugging Face的可编程机器人Lavender,整合了视觉、图像生成与语音能力。

Are you excited to be at Dev Day?

Harness在AI工程语境中指围绕模型搭建的一套执行框架,包含任务调度、工具调用、错误处理、结果验证等"脚手架"逻辑,是让模型从"能回答问题"变成"能完成任务"的关键中间层。OpenAI将Codex harness开源,意味着开发者可以看到并复用驱动Codex和Dots的底层任务编排方式,而不必从零摸索如何让模型可靠地执行多步骤工作流。ZDR(Zero Data Retention)则是企业级隐私合规的常见架构,指请求处理完成后立即丢弃数据、不写入任何持久存储,Private Intelligence通过ZDR保证即使是前沿模型的推理过程也不会留下用户数据痕迹,以满足金融、医疗、法务等高合规要求行业的需求。

分发与生态:让开发者建立生意

每周12亿人使用ChatGPT,OpenAI希望把这个平台变成开发者的商业机会。Sign in with ChatGPT让用户可用自己的ChatGPT订阅token登录第三方应用,降低开发者的获客门槛,首批16个合作伙伴上线。

Plugin Extensions允许开发者构建感觉原生于ChatGPT的完整应用——编辑器、仪表盘、工作区都能嵌入,Figma、Adobe等数十家伙伴已在打造相关扩展。插件还能在对话流中被智能发现:当用户提问时,ChatGPT会识别哪个插件有帮助并当场连接。OpenAI同时简化了插件提交流程,支持跟踪审核、请求人工复核和增量更新。

Sign in with ChatGPT本质上是一套OAuth授权机制,类似于"用Google/微信登录"的模式,但其独特之处在于用户可以将自己已有的ChatGPT订阅额度直接带入第三方应用消费,开发者无需自行管理AI调用成本和用户账户体系。这对独立开发者和小团队意义重大:获客成本降低(用户无需注册新账户),计费复杂度降低(依托OpenAI现有订阅体系),同时天然继承了用户在ChatGPT中已建立的偏好和插件连接。Plugin Extensions进一步将这一逻辑延伸——开发者不再只是调用API构建外部应用,而是可以将完整的UI界面嵌入ChatGPT对话流,使产品对用户而言感觉像ChatGPT的原生功能,降低用户的心理切换成本。

从工业革命到新文艺复兴

发布会尾声,Sam Altman表达了一个价值取向:他不认同把AI比作"新工业革命"——那意味着让人成为机器里越转越快的齿轮。他更倾向把理想中的AI未来形容为"新文艺复兴",即让人对自己的生活拥有更多掌控,获得更多创造、学习和探索的工具。

这一届DevDay的信息密度极高,但主线明确:OpenAI正把AI从对话框推向真正能自主执行、跨应用协作的工作伙伴形态,同时通过更优的价格/速度组合和开放的分发生态,把这些能力交到开发者手中。至于这些宏大愿景能否兑现,仍需在实际使用中检验。

分享:

相关推荐