[控场AI]
· 6 分钟阅读· 3,369 字

Claude Opus 5.5实力飙升,但Meta Muse才是真正的变局者

Claude Opus 5.5实力飙升,但Meta Muse才是真正的变局者

Opus 5.5、GPT-6工具语音、Meta Muse三线并发,各大厂正收敛至同一个人智能体形态。

本文是一位AI博主烧掉3000美元后整理的周度观察,聚焦三条主线:Anthropic的Opus 5.5在写作自然度、纯代码生成视频和前端设计上实现三重跃升,被评为目前最聪明的模型;OpenAI为GPT实时语音加入全工具调用,可边对话边操控Slack、Notion等27个插件;Meta的个人智能体应用Muse凭借免费(每月一亿tokens)与极快速度登顶App Store,并通过Ray-Ban眼镜和钥匙扣吊坠布局硬件入口,意在绕开苹果生态。更深层的信号是:OpenAI、Anthropic、Cognition都将在一个月内推出各自的个人智能体,各家能力正收敛至持久记忆、工具调用、语音和环境感知的同一形态,"成为Agent Native用户"被作者视为当下最紧迫的认知升级。

AI模型与智能体的竞赛进入白热化阶段。Anthropic发布Opus 5.5仅两小时后,OpenAI紧跟推出GPT-6 Sol与Luna,而真正搅动格局的,却是Meta那款一夜登顶App Store的个人智能体应用Muse。这位AI博主自称两周内烧掉3000美元测试这些新模型和新工具,带来了一份信息密度极高的周度观察。

Opus 5.5:写作、代码视频与前端设计的三重跃升

Anthropic把Opus 5.5的发布重点压在了写作风格上。官方说法是让模型"沟通更自然",回应了用户对Opus 5最集中的反馈。这类改进无法从发布会PPT上直接感知,必须亲自使用才能体会到差异。

博主的直观感受是:当你抛出一个需要长篇回答的问题时,Opus 5.5总会把最重要的信息放在开头,整体表达更简洁,在讨论复杂话题时明显更容易对话。他回顾说,大约七个月前的Opus 4.6曾是历史上提升最大的一代,聊起来genuinely有趣;但此后几次迭代反而让人觉得"越来越笨",直到5.5才重新找回"最聪明"的手感。

Kevin NGO在X上分享的纯代码生成视频

真正让人惊艳的是纯代码生成视频的能力。Opus 5.5可以把一整段动画视频压缩进一个JavaScript文件里。博主实测后与模型来回迭代,生成了约1300行代码,产出do.html与渲染文件,最终跑出一段完整动画。他特别推荐关注X上的Kevin NGO,其作品质量相当惊人。

第三项、也是博主自己用得最多的,是前端设计与artifact生成。任何偏视觉化的产物——网页、移动端视图、幻灯片——Opus 5.5都表现出极强的视觉审美。在新的Claude Projects功能中,模型不再只甩给你一个设计链接,而是直接交付一个Claude Design项目,支持多轮迭代,连手机端请求生成的slide deck也相当耐看。

GPT实时语音:边说话边调用全部工具

OpenAI给GPT语音加上了实时工具调用能力。在iOS应用或桌面端,实时语音模型现在可以直接使用email、calendar、Slack等插件,配合刚发布的GPT-6 Astra、Sol、Luna模型,相当于让语音智能体能操作你工作中接入的所有应用。

语音智能体完成Slack消息发送

博主演示了一套完整流程:他已接入27个插件,通过实时语音让ChatGPT搜索最近的Slack消息、给同事Emily发私信、在Notion里找到名为"weekly update"的文档,并要求在特定标题下补充表格、把callout改成tab布局。整个过程界面会实时显示工具调用动作,而他可以在模型执行期间持续对话。他评价这种衔接"seamless到有点夸张"。

Muse成全球增长最快的平台,扎克伯格的"ChatGPT时刻"

本期最大的变量是Meta的个人智能体应用Muse。它定位类似Grokbot——一个能帮你处理邮件、控制Notion、调用浏览器、访问电脑的个人智能体,并且会主动帮你做事。

差距悬殊的是增长:Muse已超越ChatGPT成为App Store下载榜第一,而Grokbot要翻到第196位才找得到。Muse同时覆盖网页、桌面和iOS三端,底层用的是Meta自研的muse spark 1.3模型(博主预测可能会开源),速度极快、交互有趣,还会主动给建议、追踪你的目标,并把生成的资产存进内置资料库。

关键在于它免费:每月赠送一亿tokens,博主称自己"没给Meta付过一分钱"却在业务中频繁使用。这种"免费+好用"的组合,让他直言"不知道别人要怎么竞争"。

Muse深受OpenClaw启发

刚结束的Meta Connect几乎全程围绕Muse展开。扎克伯格宣布Muse加入语音与实时视频,能在你说话时于后台干活;同时把能力接入Ray-Ban眼镜,支持全天候免提交互。

硬件野心:无摄像头音频眼镜与Muse吊坠

Meta还发布了最轻的、不带摄像头的纯音频眼镜,以及一款钥匙扣式的Muse吊坠——把完整的实时语音与avatar能力塞进一个随身小设备,点一下指纹传感器即可对话,无需解锁手机或打开App,计划在今年圣诞节前发货。

Meta Ray-Ban眼镜的摄像头与麦克风

博主点明了扎克伯格的深层动机:Meta的产品长期受制于苹果的App Store,而眼镜与吊坠这类硬件能让用户绕开苹果设备、直接接触Muse。这也解释了Meta为何豪掷巨资招揽Nat Friedman、以约150亿美元收购Scale AI及Alexander Wang——目标是打造通往"个人超级智能"的入口。

Nat Friedman坦言,Muse虽是从零构建,但作为产品"深受OpenClaw广告启发"。他在年初用过OpenClaw后,为团队买了数百台Mac mini,团队许多人爱上了这类个人智能体,并盛赞作者Peter Steinberger的harness设计具有开创性。Muse的目标正是把OpenClaw的优点做成安全、易用、可服务数十亿人的产品。

"环境上下文"(Ambient Context)是当前个人智能体竞争的核心概念之一,指智能体通过持续感知用户所处的物理与数字环境——位置、日程、对话历史、当前使用的应用——来主动推断用户需求,而非等待用户明确发出指令。这与传统的对话式AI有本质区别:传统模式是"用户问、AI答",而具备环境上下文能力的智能体会在你开会结束后主动总结待办事项,或在你走近咖啡馆时提醒你有一条未回复的消息。眼镜和耳机等随身硬件之所以被视为战略要地,正是因为它们能以最低摩擦的方式持续采集环境信号——麦克风捕捉周围对话,传感器感知运动状态——从而让智能体真正做到"随时在线、适时介入"。这也解释了为何Meta、苹果、谷歌同时押注穿戴式设备:控制了感知入口,才能喂给智能体最丰富的上下文。

所有巨头正收敛到同一形态

博主透露,据较可靠的消息,OpenAI、Anthropic以及打造Devon的Cognition都将在一个月内推出各自的个人智能体。X上流传着OpenAI一个代号Aeon(A-E-O-N)的项目,据称不只是聊天机器人,还带有个人资料、私信和群组,围绕AI构建完整的社交层,可能在Dev Day亮相。这或许也是Meta如此激进推Muse的原因之一。

他引用业内观点指出,几乎每家大厂都在抵达大致相同的能力集:持久记忆、邮件日历消息接入、浏览器与电脑操作、后台任务、主动通知、语音、应用与工具调用,以及"环境上下文"——这正是眼镜和语音如此重要的原因,随身设备持续感知环境,才能让智能体在恰当时机推送相关信息。

未来的竞争将沿不同维度展开:Anthropic要在"强大但耗token"与"快速如Muse"之间取舍;各家还要决定面向工作场景还是个人场景、服务哪类用户。博主的结论很直接——成为"agent native"(智能体原生)用户,理解并用好智能体,从未像现在这样重要。

"Agent Native"(智能体原生)借鉴自早年的"Mobile Native"概念,指那些将智能体作为默认工作流而非辅助工具的用户或企业。Mobile Native一代从一开始就围绕手机设计产品与流程,而非把PC端体验搬到手机上;类比地,Agent Native用户会把持久记忆、后台任务、主动通知等能力内化进日常决策链条,而不是偶尔打开聊天框问几个问题。这一区分在商业竞争中已开始产生实质影响:Agent Native用户能把智能体的复合效益最大化,而仅把AI当搜索替代品的用户则难以感知代际差异。博主反复强调这一概念,暗示当前窗口期对于建立认知优势至关重要——一旦个人智能体普及,早期深度用户将在工作效率与产品判断力上形成难以追赶的差距。

分享:

相关推荐