[控场AI]
· 9 分钟阅读· 4,933 字

AI智能体走进现实世界:Muse、Grokbot与消费级代理之争

AI智能体走进现实世界:Muse、Grokbot与消费级代理之争

从Claude发现类CRISPR酶到Muse登顶App Store,个人AI代理正从争议走向现实落地。

本文围绕AI代理从实验室到消费端的全面扩张展开讨论。Anthropic宣称Claude以1万美元算力成本发现了类CRISPR酶系统,但业界批评其宣传过度、功能尚待验证。联合国场合,特朗普将AI改名"超级智能"并拒绝全球监管框架,Altman与Amodei则分别从温和与激进角度阐述治理主张。消费级代理是否有真实需求的争论中,Ben Thompson认为人们只想被娱乐而非被优化,但反方以"杂活外包"需求和20亿位母亲的现实予以反驳。Meta的Muse登顶App Store,《纽约时报》记者的亲测报道将其定性为"最有用AI应用",MetaConnect同期发布了眼镜集成和随身设备Muse Charm,xAI也将Grokbot带入特斯拉。硬件形态能否成为代理普及的关键桥梁,以及从被动响应转向主动服务是否才是真正秘诀,成为当下最值得观察的两个问题。

个人AI智能体究竟有没有市场?这个争论最近因为一批新产品的爆发而重新升温。Meta的Muse、xAI的Grokbot等代理产品正在从屏幕走向现实世界——装进你的智能眼镜、嵌入你的特斯拉、甚至成为一枚挂在身上的随身设备。同时,围绕"人们到底想不想要被优化的生活"这一根本问题,科技圈分裂成了鲜明的两派。

Anthropic的生物学突破引发争议

在讨论消费级代理之前,有必要先看一个更硬核的进展。Anthropic宣称取得了一项"生物学领域的重大AI突破":在仅有科学家高层级指引的情况下,Claude发现了一套具有类似CRISPR特性的全新酶系统。

CRISPR是基于细菌中发现的酶序列的基因编辑技术,用于机械地切割DNA并插入新基因。Anthropic表示,这项发现动用了1000个Claude智能体、耗时21小时、消耗约2.1亿token——换算下来约1万美元的算力成本。

CEO Dario Amodei(本人拥有生物物理学博士学位)在X上推广了这一成果。他写道,很容易把这当作一次性的猎奇事件,但AI在新智力领域的表现往往会在几年内从薄弱跃升到超人水平。他以数学能力为例描述了这种指数级曲线,并断言"AI用于生物学正处于类似的指数趋势上"。

Anthropic与各方在联合国探讨AI风险

不过业界反应相当审慎。曾做过基因组挖掘工作的Lucas Harrington指出,找到一簇奇怪的基因和重复序列往往是最简单的部分,真正的发现在于搞清楚这个系统究竟做什么——而Anthropic目前并不知道。他认为用"重大发现"的框架来宣传这类非常早期、增量式的成果并无益处,反而不利于真正突破到来时的认知。正如Tanishq Abraham总结的:"很酷,人们应该为之兴奋,但它也非常、非常、非常初步。"

CRISPR-Cas系统最初于2012年由Jennifer Doudna和Emmanuelle Charpentier团队开发为基因编辑工具,两人因此获得2020年诺贝尔化学奖。其核心原理是利用向导RNA引导Cas9蛋白精准定位并切割特定DNA序列,从而实现基因的删除、修正或插入。这项技术已在遗传病治疗、农业育种、癌症研究等领域产生革命性影响。Anthropic所称的"类CRISPR特性酶系统",意指Claude在微生物基因组数据中识别出了具有类似核酸酶活性的蛋白质簇——这类工作在传统生物信息学中依赖研究人员手动分析大量序列比对结果,极为耗时。然而,批评者的核心质疑在于:计算层面的"识别"与实验室层面的"功能验证"之间存在巨大鸿沟。一个基因簇在序列上表现出与已知编辑系统的相似性,并不等同于它真正具备切割、编辑DNA的能力,更不意味着它在生物医学上具有可应用的价值。这也是为何领域专家将此定性为"非常初步"的发现。

特朗普给AI改名"超级智能"

在联合国的一场演讲中,特朗普做了一件颇具话题性的事:他宣布美国政府从此将人工智能(AI)改称为"超级智能"(Superintelligence, SI)。他的理由是"artificial(人工)这个词听起来像假的,但它不是假的"。

特朗普在联合国演讲拒绝全球化AI监管

这番表态引来无数玩梗。Replit CEO Amjad Massad调侃道:"它是假的、是人工的?我的可是超级的。"而AI安全倡导者Zvi则担忧这个命名会造成巨大的"命名空间冲突"。

改名之外,演讲的实质部分是特朗普明确拒绝"全球主义的AI监管方案"。此前,由芬兰牵头、法德新加坡等20国签署的宣言呼吁建立强制性独立安全测试、共同标准,以及一个国际AI机构。但这一提议的致命缺口在于:中美都不支持设立新的国际监管机构。白宫科技顾问Michael Kratios强调,繁荣的未来"不会由全球监管者来保障,而是由采纳超级智能的主权国家、负责任的公司和拒绝被恐惧统治的自由人来保障"。

同一场合,Sam Altman与Dario Amodei也向安理会阐述了对AI风险的看法。Altman居中调和,强调既不要"盲目乐观"也不要"末日主义",并点出两大风险:递归自我改进让前沿实验室构建出无法理解或控制的模型,以及权力的过度集中。Amodei则更为激进,称这是"当今世界面临的最重要的全球安全问题",并给出了签署简单条约、建立全球评估验证系统、制定测试标准等一整套治理路线图。

消费级代理:人们到底想不想要

节目的核心议题回到了个人代理。Grokbot、Muse以及Instinct等一批新产品的涌现,让关于消费级代理的讨论显著升温。但也有不少人抱持深层怀疑。

Stratechery的Ben Thompson在多次采访中反复表达一个观点:"消费者并不在乎变得高效。"他说自己有私人助理十年,对方从不帮他订机票——因为他知道哪些航班会延误、想坐哪个座位。他还抛出一个犀利论断:"人们热爱购物,他们不想要高效,他们想要被娱乐。"更进一步,他认为人们抱怨某件事并不代表不开心——"我不仅想自己做,还想一边抱怨一边做,我现在抱怨得很开心,你能让我好好过日子吗?"

类似观点还被引用了作家Kurt Vonnegut的名言:出门买一个信封本身就是一场"该死的美好时光",能遇见人、看见婴儿、消防车经过时竖起大拇指——"我们是会跳舞的动物",而电脑会把这些夺走。

用户称Muse帮他们处理琐碎的杂务

但反方声音同样有力。投资人Amy Wu Martin指出,用单一画像描绘所有人本身就是简化。金融科技创作者Simon Taylor部分认同Ben,但认为他遗漏了关键:"人是懒的,他们想把杂活(schlep work)外包出去。"给女儿预约健身课、查日历、填表、跨日历确认、付押金——这些不是购物,是"买东西",是娱乐的反面。投资人Jill Gunter更直白:"如果你不认为很多人想更高效或外包行政杂务,那你不理解世界上有20亿位母亲。"Meta的AI从业者Maruguru补充,消费者对"做事"没有单一关系——浏览衣服可以是娱乐,但找个修屋顶的工人对大多数人就是折磨。

"消费级代理"(consumer agent)指的是能够代替用户自主执行多步骤现实任务的AI系统,区别于传统聊天机器人的单轮问答模式。其技术基础依赖于大语言模型的工具调用(tool use)与多步骤规划能力:代理可以调用日历API、填写网页表单、拨打电话、管理邮件,并在任务链中自主决定下一步行动,仅在关键节点寻求用户确认。这与此前"助理"类产品(如Siri、Google Assistant)的本质区别在于:后者主要回答问题或执行单一指令,而代理能够在无持续人工干预的情况下完成跨应用、跨平台的复合任务。Ben Thompson所指的"高效化"批评,针对的正是一种过度工程化的代理愿景——假设用户希望将所有决策外包。而支持者的反驳则区分了两类需求:有情感价值的体验(购物、浏览)不应被代理,但纯粹消耗时间精力却毫无回报的行政杂务(schlep work)则是代理的理想用武之地。

证据开始出现:Muse登顶与真实体验

与AI未来的许多争论不同,这一次我们开始能拿到真实证据。截至录制时,Muse仍稳居App Store第一。更关键的是,它从一些意想不到的地方获得了正面口碑。

《纽约时报》的Eli Tan发表了一篇让许多人意外的文章,标题是《我把生活交给了Meta的AI代理,结果被震撼到了》。他发现Muse能高效填写在线表单、给停车罚单拍照后代为缴费(付款前请求批准)、用不同人格打电话处理客服(如牙科保险),甚至在Facebook Marketplace上主动给卖家发消息并代为砍价成交。他的结论是,Muse是他用过"最有用的AI应用"。

值得玩味的是,这段体验改变了他怀疑的焦点:进入时他怀疑代理是否足够有用,出来时他担心的是——是否有足够多的人愿意为了获得这种实用性而接受隐私层面的代价。

为了提升实用性,Meta首席AI官Alexander Wang在社交媒体上密集宣布与Spotify、Box、Sephora、Gap、Walmart等公司的合作。Muse的Mac应用新增了电脑操作能力,还推出了可视频对话的实时虚拟形象。

走进现实:智能眼镜、随身设备与特斯拉

在MetaConnect大会上,Muse被带入了最新款Meta眼镜。扎克伯格把这项功能列为首要公告:"Muse现在有了语音和实时视频,你可以进行长对话,它会在后台替你把事情办好。"Meta Ray-Bans也迎来产品线刷新,首次推出无摄像头的纯音频款。

最受关注的是扎克伯格以"还有一件事"方式压轴发布的新品类——Muse Charm。它大约只有秒表或AirPods充电盒大小,是一款常开设备,带小彩屏,可直接接收语音指令,无需解锁手机或打开应用。扎克伯格称对于没有Meta眼镜的人,这将是"与Muse对话最快的方式",并希望在假期前出货。

Muse Charm:AirPods盒大小的常开AI设备

这类产品在半年前几乎会被本能地否定——无论从代理能力还是对Meta来源的怀疑角度。但这次的反响明显更积极。软件工程师Babyfolio认为"把AI带入现实世界,可能让更多人用起来,尤其是那些不会每天打开聊天机器人应用的人"。Silicon Data研究主管Steve Howe回顾Humane AI Pin、Rabbit R1等前车之鉴后表示,"这次可能真的变了"——过去是AI不够好以至于人们仍离不开手机,而现在情况或许已经改变。

这股趋势不止于Meta。xAI也在将Grokbot推向特斯拉。车主可以在使用全自动驾驶的同时,用语音在车内下单星巴克、购买AirPods、管理邮件日历和财务,一切都在现有Grok语音界面内完成,无需单独应用。

Humane AI Pin与Rabbit R1是2024年备受关注却最终遭遇口碑崩塌的两款AI随身硬件,常被援引为消费级AI设备的反面教材。Humane AI Pin售价699美元,是一枚可投影小屏幕的胸针式设备,主打无手机的AI交互体验;Rabbit R1售价199美元,定位为"自然语言操作手机应用"的独立设备。两款产品的共同失败原因在于:底层AI能力不足以支撑其宣传的使用场景,实际体验远逊于直接使用智能手机,且功能基本可被手机应用复现。这一背景使得Steve Howe所说的"这次可能真的变了"具有特殊分量——他的判断是,过去硬件先行、AI能力跟不上;而当前时间点,AI代理能力已足够强,硬件形态的意义在于降低调用门槛、让不习惯主动打开应用的用户也能自然融入代理工作流。Muse Charm和Meta眼镜的定位逻辑,正是建立在这一能力门槛已被跨越的假设之上。

两个值得观察的问题

当然,怀疑并未消失。Riley Brown指出Muse登顶的数字难以完全信任,他拿Threads类比——很多用户可能是被Instagram"诱导"下载的。但他也分享了一个细节:在纽约一场扑克牌局上,几位科技圈外的成功人士(银行家、医生、保险从业者)大多听说甚至使用过Muse,他们描述为"一个你不用吩咐它就开始替你工作的AI",并不关心模型本身,只是喜欢它会提醒事情、取消订阅。

这留下两个关键问题:第一,智能眼镜、随身设备这类"硬件桥梁"对代理的普及究竟有多重要;第二,真正的秘诀是否正如那些扑克牌友所暗示的——从被动响应的体验转向主动服务的体验,在你开口之前就把价值送到你面前。

至少目前,个人代理领域的风向正在转变,而越来越多亲自尝试这些产品的人,发现自己比预想中更为惊艳。

分享:

相关推荐