AI快讯:DeepSeek桌面版上线、Claude Sonnet 5.5秘密测试、OpenAI推$500 Pro套餐

AI大厂一周动态:模型迭代、定价重构与太空算力齐头并进
本周AI行业多条主线同步推进。模型层面,Claude Sonnet 5.5进入合作伙伴秘密测试并展示出强劲的代码与创意生成能力,MiniMax M3.1以"Space Bunny"隐身身份在OpenRouter完成公测,Opus 5.5则以1818分登顶Web Dev榜并以远低于GPT-6的价格形成性价比优势。商业层面,OpenAI订阅页面出现每月500美元Pro套餐,产品线重组信号明显。基础设施层面,Google即将发射首颗轨道AI数据中心试验卫星,软银完成111亿美元高收益债创纪录发行,DeepSeek Harness也推出免去Node.js依赖的官方桌面版预览。安全层面,针对ChatGPT、Gemini等主流AI的规模化投毒攻击被曝光,374家知名企业受波及,凸显AI信息入口的安全隐患。
AI行业的更新节奏正在以周为单位刷新。从模型发布到订阅套餐,再到基础设施投入,这一批新动向勾勒出大厂竞速的最新格局。以下梳理值得关注的几条核心资讯。
DeepSeek Harness 桌面版悄然上线
DeepSeek广告 Harness 推出了官方桌面版的开发者预览,版本号为 V0.17 RC2。相比过去需要依赖 Node.js 环境、打开终端手动运行 NPX 的做法,桌面版免去了这些前置步骤,直接降低了上手门槛。
目前该版本支持 Windows X64 与搭载 Apple Silicon(M 系列芯片)的 macOS 平台。需要留意的是,官方尚未正式发布,当前仍属于早期预览阶段,适合愿意尝鲜的开发者体验,稳定性上可能存在变数。
OpenAI 出现每月 $500 的 Pro 套餐
OpenAI 的订阅页面被发现新增了一档每月 500 美元的 Pro 套餐,宣传语仅有一句「Fastest Work and Codex」。从措辞看,这一档位主打的是速度与 Codex 编程能力。
不过目前尚不清楚它在用量额度上是否与现有的 200 美元套餐存在实质区别——唯一可以确定的是响应速度会更快。有意思的是,200 美元的 Pro 套餐当前反而处于无法订阅的状态,这一档位的调整或许预示着 OpenAI 正在重新划分高端订阅的产品线。
Claude Sonnet 5.5 进入秘密测试
据爆料人 Lira 的消息,Claude Sonnet 5.5 已经在合作伙伴范围内秘密测试,并开放了 24 小时访问权限。其规格与定价被指对标刚发布的 GPT-6,而 Haiku 5.5 预计将与 Sonnet 5.5 同步发布。
从流出的测试案例看,Sonnet 5.5 展示了涂鸦风格的 FPS 射击游戏、像素风的樱花宝塔等生成效果,代码与创意生成能力值得期待。

除了游戏化的演示,测试中还包括用一段 60 秒动画来解释「圆的面积为什么是 πr²」这类需要数理推导与可视化结合的任务,反映出新模型在复杂多步生成上的进步。

MiniMax M3.1 以隐身模型形式亮相
社区基本确认,此前在 OpenCode 和 OpenRouter 上以「Space Bunny」代号免费开放一周的隐身模型,正是 MiniMax M3.1。相关仓库与测试配置已被发现,模型名确认为 MiniMax M3.1,支持超长上下文,推理档位为 Max Reasoning,MiniMax Code 中也随处可见对它的引用。
从免费隐身测试的节奏推断,一旦隐身期结束,很可能就是正式上架的时间节点。M3.1 的多模态理解能力表现不俗,测试案例覆盖了在单个 HTML 文件中构建 GPU 流体模拟、用单个 HTML 复刻《我的世界》、无反相机的 3D 解剖、照片生成 3D 模型,以及用 three.js 制作可玩 3D 游戏等,展示面相当宽泛。
「隐身模型」(Stealth Model)是 AI 行业近年兴起的一种发布前测试策略:厂商以匿名或化名将模型接入第三方平台(如 OpenRouter、LMSYS Chatbot Arena),让用户在不知晓模型身份的情况下进行真实使用,从而收集无偏见的性能反馈与用量数据。这种方式既能规避正式发布前的舆论压力,又能通过大规模真实调用暴露边缘案例,与传统的内部 A/B 测试相比覆盖场景更广。OpenRouter 作为多模型统一调用平台,因其流量大、用户技术水平高,已成为隐身测试的热门渠道。
其他值得关注的模型与产品动态
Claude Opus 5.5 登顶 Web Dev 榜。 Opus 5.5 以 1818 分登顶 Code Arena 的 Web Dev 榜首,重塑了帕累托前沿,相比 Opus 5 大幅提升 126 分,且价格比第二名的 GPT-6 便宜约 60%,性价比优势明显。
Odyssey 发布 Agora 2。 这是新一代多智能体世界模型,支持最多 20 个人类与智能体在共享环境中实时互动,底层没有游戏引擎,全部由模型实时模拟——这对世界模型的实时推理能力提出了很高要求。
Nano Banana 2.5 Flash 临近发布。 其调用痕迹已在 Google Flow 上被发现,距离正式发布应该不远。

其他模型进展: Savam Vision 2.1 在 OmniOCR Bench 上取得 87.3 的总体成绩,超过同类竞品;对比学习驱动的 CLM(Contrastive Language Model)发布,CLM 8B 推理速度最高可达同类的 9 倍,同时在计算机操作、游戏和工具调用任务上保持相当性能。此外,智谱 GLM Coding Plan 的双节活动延期至 10 月 7 日,期间 GLM 5.3 Flash 在部分场景免费无限用、Agent 额度翻倍。
开源与基础设施:Fuzzing 自动化与太空数据中心
GitHub Security Lab 的 Antonio Morales 开源了基于 Taskflow Agent 的 Fuzzing 工具。用户只需指向一个 GitHub 仓库,它就能自动识别入口点、编写 Harness、运行 AFL++、读取覆盖报告并分析崩溃,把过去繁琐的模糊测试流程做成了自动化 Agent。

基础设施层面同样有大手笔。Google 将于 10 月 1 日通过 SpaceX Falcon 9 的 Transporter 18 拼车任务发射首颗 Project Suncatcher 试验卫星,目标是验证轨道 AI 数据中心的可行性——把算力搬到太空的构想开始进入工程验证阶段。资金端,软银完成 111 亿美元及欧元计价债券发行,创下全球规模最大的高收益企业债券发行记录,资金用于支持其对 OpenAI 的布局。
Fuzzing(模糊测试)是一种自动化软件安全测试技术,通过向程序输入大量随机或半随机数据来触发崩溃、内存错误或未定义行为,从而发现潜在漏洞。AFL++(American Fuzzy Lop Plus Plus)是目前最主流的覆盖率引导型模糊测试工具,它通过插桩技术追踪代码执行路径,智能地变异输入样本以最大化代码覆盖率。传统 Fuzzing 工作流需要安全研究员手动编写"Harness"(测试驱动程序,负责将模糊输入喂给目标函数),这一步骤往往耗费大量时间且需要深入理解目标代码结构。将 AI Agent 引入 Fuzzing 流程,核心价值在于将「识别攻击面→编写 Harness→分析崩溃」这条本需人工介入的链路自动化,大幅降低了对目标项目进行安全审计的门槛。
安全警示:针对 AI 的虚假信息攻击
安全研究者发现了针对 ChatGPT、Gemini 和 Google AI Overview 的规模化 AI 虚假信息攻击,共检测到 374 家被攻击企业,包括 Delta、Lufthansa、Bank of America、Airbnb 等知名品牌。攻击的效果是让 AI 向用户给出诈骗电话和钓鱼链接。随着 AI 搜索与摘要成为用户获取信息的主要入口,这类「投毒式」攻击的危害性正在被放大,值得开发者和平台方高度警惕。
这类攻击通常被称为「SEO 投毒」(AI SEO Poisoning)或「间接提示注入」(Indirect Prompt Injection)的变体。攻击者通过在网络上大量创建或篡改页面,将虚假的客服电话、钓鱼链接等恶意内容注入 AI 训练数据或实时检索索引,使语言模型在回答「XX公司客服电话是多少」等查询时输出攻击者预设的内容。与传统网络钓鱼不同,此类攻击借助 AI 的权威感降低了用户的戒备心——用户更倾向于信任「AI 给出的答案」而非直接点击可疑链接。随着 AI 搜索摘要(如 Google AI Overview、ChatGPT Search)取代传统蓝链成为信息入口,单次成功投毒可以影响数以百万计的终端查询,危害规模远超传统 SEO 黑帽手段。
小结
这一批资讯集中反映了三条主线:模型能力的快速迭代(Sonnet 5.5、MiniMax M3.1、Opus 5.5)、订阅与商业模式的重新定价(OpenAI $500 套餐、GLM 活动),以及基础设施与安全层面的深层变化(太空数据中心、软银巨额融资、AI 虚假信息攻击)。竞争已不再局限于跑分,而是延伸到成本、部署门槛与安全信任的全面较量。
相关推荐

一场与Grok的对话能否影响重大决策?素材不足的警示
一则关于美国因与Grok对话影响委内瑞拉决策的Hacker News标题引发关注,但缺乏正文与信源。本文探讨此类耸动标题的识别方法与AI在决策中的真实边界。

AI编程为何离不开Git?从版本回退到AI辅助命令全解析
Git是AI编程的必备工具。本文解析Git分布式版本控制在AI编程中的价值,包括应对AI幻觉的版本回退、分支管理等核心操作,以及如何用豆包、AI输入法等工具快速生成Git命令,帮助新手零基础入门。

拒绝AI胡编:一款"说不了谎"的求职信生成器是如何炼成的
一位开发者因AI求职信工具凭空捏造其Kubernetes经验和管理经历而屡遭拒信,于是打造了CoverCraft——通过代码计算评分、GitHub提交记录背书、对抗性审查与人工审批四重机制,构建一款"无法说谎"的AI求职信生成器。本文解析其对抗AI幻觉的工程设计。