AI早报:OpenAI暂停Pro订阅 DeepSeek开源V4.1 Flash

2026年9月11日,OpenAI限流Pro订阅、DeepSeek全栈开源多模态MoE模型,AI能力竞赛与安全警报同步升温。
2026年9月11日,AI行业在产品、模型与安全三条线上同步密集推进。OpenAI因算力压力暂停200美元Pro新订阅,同时在企业市场推出全双工语音API、Agents API公测及金融专属ChatGPT;DeepSeek开源552B参数的多模态MoE模型V4.1 Flash,并同步发布完整工具链,进一步降低国产大模型的部署门槛。编程Agent赛道,Cognition的SWE2宣称成本较前沿模型低70%,Cursor推出多层级Agent编排的Projects功能并以CursorBench 4.0揭示长程任务能力缺口。国内高德发布3D世界生成模型,杭州以55%补贴推动AI编程普及。Anthropic红队则警示:前沿模型在武器情报领域已接近人类专家水平,安全治理刻不容缓。
AI早报速览:2026年9月11日
2026年9月11日,AI行业迎来密集的产品与模型更新。从OpenAI暂停高价订阅、DeepSeek开源全新多模态模型,到Cognition、高德、Cohere等厂商的重磅发布,本篇将系统梳理当日的核心动态与背后趋势。
OpenAI暂停Pro新订阅,密集推出企业级功能
Codex负责人Tibo宣布,暂停开放200美元的Pro新订阅,以保障现有用户对Astra的持续使用。他解释称,这类高价订阅对系统压力最大,而其他订阅方案与API仍可正常使用,现有账户不受影响。有用户观察证实,ChatGPT网页端的20倍Pro购买入口已显示暂停提示。
这一举措折射出前沿模型算力供给的紧张现实——即便是OpenAI这样的头部厂商,也不得不通过限制高负载订阅来平衡系统承载能力,优先保障存量用户体验。
同时,OpenAI在企业级市场大举发力:
- GPT Live登陆API:该模型可边听边说,支持即时打断、深度推理与工具调用,并可将复杂任务委托给后端模型处理。开发者能通过System Prompt定制语气风格,模型原生提供ASR转写,支持部署全双工语音Agent。
- Agents API公测版:以开源的Codex Harness驱动,帮助开发者构建并运行云端Agent。OpenAI负责托管Agent Loop、模型调用、上下文管理与编排,该API免收额外费用,仅需为Token和工具消耗付费。
- ChatGPT for Financial Services:面向合规金融机构开放,内置美欧多来源付费金融数据,支持细粒度引用溯源,可用公司模板生成估值模型等文件。

此外,OpenAI还在ChatGPT Work推出Data Agent(用自然语言将企业数据转为交互式仪表盘)、股票自选清单功能,并原生集成Dropbox、Box与SharePoint。据博主Andrew Curran转述,OpenAI已向《纽约时报》确认,在另一道千禧年大奖难题上取得实质性进展。

DeepSeek开源V4.1 Flash多模态模型与配套工具链
当日最受关注的开源动态,无疑是DeepSeek发布并开源的原生多模态MoE模型 DeepSeek V4.1 Flash。
模型架构与核心性能
该模型总参数量达552B,采用Coastal Encoder-Decoder结构,输入激活8B、输出激活16B,并大幅优化了KV Cache对HBM与SSD的需求。官方称其各项指标全面超越V4 Pro,并计划于9月14日12点后下线V4 Pro。API已同步全面上线,取代旧版Flash模型,新版定价按峰谷分时策略执行。
从架构设计看,V4.1 Flash对KV Cache的优化尤为关键——这直接降低了长上下文推理的显存与存储压力,是MoE模型走向工程落地的重要一步。
完整工具链同步开源
为方便部署V4.1 Flash及后续开源模型,DeepSeek一并开源了三个代码仓库:
- DeepSeek Recipe:用于API协议转换与提示词编解码;
- DeepSelect:加速吸收注意力与采样中的Top-K散子;
- DeepJet:支持CUDA与昇腾内核的JET编译与缓存。
配套的DeepSeek Harness也发布了v0.1.5,新增V4.1 Flash适配、KV Cache保留、系统提示词更新及Agent Teams等功能。DeepSeek App与网页端则将原有三种模式合并升级,接入新模型,并上线未成年人模式与一键登出功能。

这套从模型、工具链到应用端的完整开源组合,体现了DeepSeek一贯的开放策略,也进一步降低了国产多模态大模型的部署门槛。
编程与Agent工具竞争白热化
编程模型与Agent工具的更新在当日尤为密集:
- Cognition发布SWE2:基于Kimi K3后训练,官方称其在主要评测上与前沿模型得分相当,但成本最多低70%。该模型已上线Devon Desktop与CLI,Pro Max Teams订阅用户未来一个月内可免费使用。
- Cursor推出Projects功能:用户在单一持久会话中与协调Agent交流,由其向写代码的SubAgent委派任务。协调Agent自身不写代码,且永不被阻塞——这是Agent编排架构的一次有趣尝试。
- Codex上线Unity插件:内置技能由Unity工程师编写,覆盖项目设置、渲染、物理与AI导航等领域。
- Claude Code桌面应用:可将任意面板弹出为独立窗口,拖到第二屏幕后主窗口仍继续工作。
Cursor还推出了 CursorBench 4.0,用于评测Agent在真实、模糊、多文件任务中的表现,新增的长程问题导致所有模型得分普遍下降——这也印证了当前Agent在复杂真实场景下仍存在显著能力缺口。
国内厂商与生态动态
国内方面同样热闹:
- 杭州联合智谱推出「杭州全城Coding计划」:在杭个人与企业用户可享政府补贴购买Coding套餐,最高综合补贴达55%,企业单家补贴上限100万元。这是地方政府以真金白银推动AI开发普及的典型案例。
- 高德推出3D原生生成世界模型Aboard Earth 0.7:官方称消费级GPU约10分钟即可生成公里级3D场景,已应用于飞行街景2.0、导航Live等服务。
- Kimi启动企业合作伙伴计划,联合IT服务商共建企业级部署工程。
谷歌与其他海外厂商动态
- Gemini API文档预览版集成进AI Studio,开发者可直接在ai.studio/docs查看。
- Gemini桌面应用登陆Windows 10/11,语音功能需订阅Google AI。
- Cohere开源机器翻译模型North Small Translate,官方称其在WMT基准上超过DeepL与Google Translate,权重已上架Hugging Face(非商业许可)。
- ElevenLabs与环球音乐集团达成多年战略合作,首个产品为面向粉丝的AI创作平台。

AI安全信号值得警惕
值得关注的是,Anthropic的Frontier Red Team发布了新评测,衡量AI模型在战术情报定位与常规武器开发方面的能力。官方称前沿模型在部分任务上已接近甚至超越人类专家水平,其威胁情报团队还发现了真实的滥用案例。
这一发现为狂飙的能力竞赛敲响警钟——当模型能力持续逼近人类专家,安全评估与滥用防范的重要性只会愈发凸显。
结语
从OpenAI的订阅收缩与企业级扩张,到DeepSeek的全栈开源,再到编程Agent的激烈角逐,9月11日的AI行业清晰呈现出两条主线:一是前沿能力在算力约束下寻求平衡,二是开源与工程化工具链正快速成熟、降低落地门槛。而Anthropic的安全预警,则提醒我们在追逐能力的同时,安全治理不可缺席。
相关推荐

Treebar:Mac菜单栏管理Git工作树,一眼掌控所有AI编程Agent
Treebar是一款macOS菜单栏应用,专为AI编程多工作树场景设计。它将所有Git Worktree状态统一展示在MacBook刘海区域,让开发者实时监控Codex等AI Agent的工作进度,无需切换终端即可掌握全局。即将开源核心代码。

苹果确认Hide My Email域名永久保留,用户隐私获长期保障
苹果公司公开承诺iCloud+ Hide My Email功能使用的@icloud.com域名将永久保留,不会弃用或迁移。本文解析域名稳定性对邮箱转发隐私工具的关键意义,以及对用户账户安全的底层保障。

终端正在拖慢你:多任务时代的效率反思
终端是程序员的信仰工具,但在多任务并行的现代开发场景中,它的线性设计正在成为效率瓶颈。本文分析终端的心智负担模型为何在第六个任务时崩溃,以及开发者该如何重新评估工具选择。