OpenAI 发布 GPT-6.1 Sol:价格仅 Astra 五分之一,Codex 与 ChatGPT 齐更新

OpenAI发布低价模型Sol、升级Codex开发平台并推出团队协作工具,国产阵营同步开源加速追赶。
OpenAI本轮更新以"降本扩能"为主线:GPT-6.1 Sol在接近旗舰Astra智能水平的前提下,将价格压至约五分之一,缓存输入仅需0.10美元/百万Token,大幅降低RAG和Agent应用的调用成本;Codex从代码生成工具升级为支持三端运行、内置安全扫描的开发协作平台;ChatGPT Space与全天候Agent Dots则将协作与自动化能力延伸至团队场景,可连接超4000款应用。与此同时,国产阵营在开源与算力基建上持续发力:iQuest Q1以MoE架构开源320B参数模型,DeepSeek则开源昇腾平台全套基础设施组件,推进国产算力软硬件协同。Grok 4.7x High在网络安全基准登顶,头部厂商的多维竞速仍在加剧。
OpenAI 近日一口气放出多项更新,涵盖新模型 GPT-6.1 Sol、开发者工具 Codex、以及 ChatGPT 的协作能力升级。核心亮点是新模型在接近旗舰水平的同时,把价格压到了此前 Astra 档位的约五分之一,这对开发者和企业用户意味着推理成本的大幅下降。
本文基于 B 站 AI 日报(9 月 30 日)的整理内容,梳理这轮更新的关键信息。需要提醒的是,部分产品名称与参数为素材原文所述,实际以 OpenAI 官方发布为准。
GPT-6.1 Sol:接近旗舰水平,价格大幅下探
GPT-6.1 Sol 被定位为接近 Astra 智能水平的模型。定价方面,标准输入每百万 Token 为 2 美元,输出为 10 美元,缓存输入更是低至每百万 Token 0.10 美元。
这套价格结构的意义在于,缓存输入的极低成本对于需要反复调用长上下文、构建 RAG 或 Agent 应用的场景尤为友好。相比动辄成倍的旗舰模型费用,Sol 让「用得起大模型」成为更现实的选项。目前该模型已在 ChatGPT 中投入使用,并在 Codex 中提供调用。

同期,OpenAI 还推出了名为 Ultrafast 的高端速度档位,面向高要求负载。据素材,在 Codex 中 Token 生成最高提速可达 8 倍,API 最高提速 6 倍,Astra 超高速也已上线。这一档位需通过每月 5.0 美元的 Pro 套餐专享,属于对延迟敏感型应用的专门优化。
Token 缓存(Prompt Caching) 是大模型 API 中的一项成本优化机制:当同一段前缀(如系统提示词、长文档背景)在多次请求中重复出现时,服务商可将其计算结果缓存并复用,从而对这部分输入收取更低的费用。GPT-6.1 Sol 的缓存输入定价仅为标准输入的 5%(0.10 美元 vs 2 美元),意味着构建知识库问答(RAG)或多轮对话 Agent 时,反复携带的长上下文部分几乎可以忽略不计,整体调用成本将随缓存命中率的提升而显著下降。
RAG(检索增强生成) 是一种将外部知识库与语言模型结合的架构:系统在生成回答前先检索相关文档片段,再将其拼入提示词交给模型处理。由于每次调用都需携带检索到的长文本,RAG 场景对 Token 用量极为敏感,缓存定价的大幅下调对该类应用尤为关键。
Codex 全面进化:多端运行与安全扫描
Codex 这次的更新方向很明确——从单纯的代码生成走向完整的开发协作平台。
Codex Cloud 现已支持本机、手机与云端三端运行,提供可复用的开发环境,团队之间可以共享配置。这意味着开发流程不再被单一设备束缚,移动端也能承担部分开发任务。
此外,Agents API 开启预览,支持「计算机使用」能力;Codex 侧还新增了语音对话与数学相关的 Agent 视图,交互方式进一步多样化。

安全方面是这轮更新的一大重点。Codex 的安全云(素材中提及 Daybreak Blue 模型)可以扫描整个代码仓库与新提交内容,在 GitHub 上自动取重并准备修复方案。对于团队而言,这相当于把代码审计与漏洞排查嵌入了日常开发流程。同时,Codex 还以插件形式在桌面端与网页端提供可分享的个人资料页,汇集站点与插件,供他人发现和复用,但权限仅限工作空间内部。
MoE(Mixture of Experts,混合专家)架构 是目前大参数量模型普遍采用的一种稀疏计算方案:模型由多个"专家"子网络组成,每次推理时只激活其中一小部分,而非全部参数。iQuest Q1 的 320B 总参数中,每个 Token 仅激活 15B,这意味着实际推理算力消耗远低于同等规模的稠密模型,在保持高性能的同时大幅降低了部署成本。Llama、Mixtral、DeepSeek广告 等主流开源模型均采用了类似设计。
昇腾(Ascend) 是华为推出的 AI 加速芯片系列,昇腾 950 为其最新高端型号,定位对标英伟达 H100/H200。DeepSeek 开源昇腾平台的 TileLang 编译器、计算库与通信库,目的是在国产芯片上复现此前基于 CUDA 生态的软件栈,使模型训练与推理框架能够在非英伟达硬件上高效运行,属于国产算力软硬件协同体系建设的关键一环。
ChatGPT Space 与 Dots:面向团队协作
ChatGPT Space 是本次面向团队协作与共创的新功能。它支持动态页面,可以包含图表、仪表板与图像,用户能让 ChatGPT 把对话内容直接转换为页面或幻灯片。该功能已对 Pro、Business、Enterprise 套餐开放。
配合协作能力,OpenAI 还推出了 Dots——一个全天候工作的 Agent。它拥有电脑与浏览器,可连接生态内超过 4000 款应用。主 Dot 已计入套餐,全天可用且不额外消耗额度,降低了长期使用的心理门槛。
此外,「使用 ChatGPT 登录」功能同期上线,合作方在授权时仅获得用户的姓名、邮箱与头像,在便利性与隐私之间做了较为克制的平衡。
「使用 ChatGPT 登录」(Sign in with ChatGPT) 是 OpenAI 推出的 OAuth 身份认证服务,功能类似 Google/Apple 登录。合作方接入后,用户可以用 ChatGPT 账号一键授权第三方应用,OpenAI 仅向对方开放姓名、邮箱和头像三项基础信息,不传递对话记录或使用数据。这一设计一方面降低了用户注册新服务的摩擦,另一方面也是 OpenAI 将 ChatGPT 从单一产品扩展为平台生态入口的重要一步——通过身份体系的打通,Dots 所连接的 4000+ 应用也可以此为纽带实现账号互通。
国产与竞品动态:开源与竞速并进
除 OpenAI 外,素材还提到几条值得关注的行业动向。
一款代号 iQuest Q1 的模型正式开源,采用 MoE 架构,总参数 320B,每 Token 激活 15B,上下文长度达 512K。在基准测试中,其 CyberGem 得分 84.5,Terminal Bench 2.1 为 83.2,配置对标高端推理需求。

DeepSeek 方面开源了昇腾平台的基础设施组件,涵盖 TileLang、计算库与通信库,与英伟达平台的开源组件一一对应,双方共同推进基于昇腾 950 的 128 卡超节点。DeepSeek 的弹性计算团队正大量招聘资深工程师,聚焦大规模 Agent 训练沙盒等基础设施,相关技术分享已发布在知乎。这反映出国产算力生态在软硬件协同上的持续投入。

竞品方面,Grok 4.7x High 在 AA 网络安全指数上登顶,马斯克称其表现超越了对标模型,并已向订阅用户开放。头部厂商在安全与性能维度的竞速仍在加剧。
小结
这轮更新的主线清晰:OpenAI 通过 Sol 大幅降低模型使用成本,同时把 Codex 和 ChatGPT 从工具升级为协作平台;国产阵营则在开源与算力基建上加速追赶。对开发者来说,低价高性能模型与多端 Agent 工具的组合,正在实质性地降低 AI 应用的落地门槛。
相关推荐

AI温和派的崛起:在狂热与末日论之间寻找中间地带
AI舆论正陷入加速主义与末日论的两极撕裂,但一群"AI温和派"正在崛起。本文梳理福山、"AI作为常规技术"作者及好莱坞制片人卡森伯格的最新观点,呈现在狂热与恐惧之间寻找中间地带的思潮。
我让Claude构建可漫步的物理精确O'Neill圆柱:AI生成3D模拟的边界
我让Claude构建可漫步的物理精确O'Neill圆柱:AI生成3D模拟的边界
一位开发者让Claude构建物理精确、可实时漫步的O'Neill圆柱太空栖息地模拟。本文解析其中的科里奥利力、重力梯度等物理挑战,以及AI生成交互式3D模拟的现实意义与局限。

破解数据锁定:用REGISTER与UNREGISTER API实现目录可移植性
湖仓架构下,开放表格式解决了存储可移植性,但目录锁定成为新难题。本文解析REGISTER与UNREGISTER API如何实现元数据松耦合,帮助企业避免厂商绑定、支持多目录协作并安全迁移数据。