[控场AI]
· 8 分钟阅读· 4,081 字

Anthropic研究员辞职引爆全网:AI安全背后的"阴谋论"真相

Anthropic研究员辞职引爆全网:AI安全背后的"阴谋论"真相

前Anthropic研究员辞职推文引爆1.72亿流量,掀起AI安全是否是权力游戏的大讨论。

前OpenAI与Anthropic预训练研究员Jacob Coxon的辞职声明以1.72亿浏览量成为科技圈史上传播最广的推文之一,引发Bernie Sanders、Sam Altman、Elon Musk、Dario Amodei等人集体回应。然而这场风波的内核远不止于一位研究员的良心发声:推文在《华尔街日报》刊文18分钟后发出、Netflix相关纪录片同周上线、账号注册即爆款等诸多巧合引发编排质疑。Dario随后提出的"嵌入式评估者"方案点名Meter,而批评者通过梳理Meter与Anthropic投资人、员工在有效利他主义圈子中的交叉关系网,质疑所谓独立第三方监管不过是变相的行业权力集中。作者最终的判断是:Dario确有主导AI发展的意图,但"大阴谋"无法证实,且Sam与Elon的公开背书很可能是"捧杀"策略。

一条获得1.72亿浏览量的推文,把AI安全争议推向了前所未有的舆论中心。前OpenAI与Anthropic预训练研究员Jacob Coxon的辞职声明,不仅引发了Bernie Sanders、Sam Altman、Elon Musk、Dario Amodei等重量级人物的集体回应,也顺势掀起了一场关于"AI安全究竟是不是一场权力游戏"的大讨论。

一条改写科技Twitter历史的推文

Jacob Coxon在辞职声明中写道:"我今天从Anthropic辞职。过去三年我在OpenAI和Anthropic做预训练研究,两家公司都没有负起责任。它们正直奔可以自我改进的超级智能,拿我们所有人的生命做赌注。"

这条推文的传播量是惊人的——约80万点赞、20万转发、超过1.7亿浏览量。这位视频作者直言,这是他见过的整个科技圈史上传播最广的一条推文,无论是AI安全领域还是更广泛的tech Twitter都从未有过。连Elon Musk都感慨,从没见过一个几乎没有互动、没有粉丝基础的账号能如此爆火。

Anthropic内部多位对齐研究负责人随后公开声援。一位对齐科学负责人Evan转发并表示:"我个人认为未来十年内AI杀死全人类的概率大于10%……我们目前还没有解决超级智能对齐问题的方案,也没有明显走在正轨上。"这番表态,把公司内部对安全风险的焦虑赤裸裸地摆到了台面上。

Wall Street Journal publishes this article referencing Jacob.

时间线上的可疑巧合

作者虽自称"不是真正的阴谋论者",却敏锐地梳理出一连串耐人寻味的巧合。

首先是媒体节奏。在Coxon发出爆款推文的18分钟前,《华尔街日报》就已经刊发了一篇引用他的文章。换句话说,一位准备辞职的研究员,在开炮之前先给了记者独家权限。作者评论道:"我从没听说过有人要辞职前,先联系媒体准备大骂前雇主的。"

更巧的是,Netflix一部耗时三年制作、专门讲AI危险的纪录片,恰好在同一周上线;《时代》杂志的封面主题也恰好是"暂停AI"。而Coxon这个账号本身也疑点重重——注册于今年,改过两次名,总共只有两条推文:最初的辞职声明和大约七天后的一场AMA。

seven days later. That's it.

这些孤立看似无害的事实叠加在一起,构成了外界质疑"这一切是否被精心编排"的土壤。

核心质疑:Dario的"评估者"棋局

事件真正的引爆点,来自Dario Amodei随后发布的文章《We Must Pace the Frontier》(我们必须为前沿踩刹车)。文中他提出三步计划,而争议最大的是第一条——嵌入式评估者(embedded evaluators)。

Dario主张,每家前沿AI公司都应当给第三方评估团队提供"类似员工权限"的持续访问,以核查其安全实践,评估的对象不仅包括已完成的模型,还包括训练流程本身。他点名的唯一一个评估机构,就是Meter。

批评者由此推演出一条逻辑链:如果Meter掌握了判定"哪家实验室有资格追求超级智能"的权力,而Meter又与Anthropic及Dario本人存在千丝万缕的联系,那么所谓"第三方独立监管"就可能变成变相的行业控制。

值得玩味的是,一向不与Dario"牵手"的Sam Altman,以及Elon Musk,都公开表示赞同Dario的"踩刹车"主张。当政界人物、竞争对手CEO们在同一时刻齐声附和时,怀疑的种子自然被种下。

Now, what connects Coxon to all of this is

嵌入式评估者(Embedded Evaluators) 是Dario在该文中提出的一种监管模式,区别于传统的"事后审查"——它要求第三方机构在模型训练阶段就获得持续的、近乎员工级别的内部访问权,包括代码库、实验日志和训练流程。这一设计的逻辑出发点是:等到模型训练完成再做安全评估,往往已经太晚,因为危险能力可能在训练中途就已浮现。然而这种模式的争议恰恰来自其"深度嵌入"的特性——评估机构实际上需要长期驻扎于实验室内部,由此获得的不仅是安全数据,还可能包括核心技术细节与商业机密。批评者认为,这种权限一旦赋予某家特定机构,该机构就天然具备了对整个行业发展节奏的实质性否决权,而非仅仅是"第三方观察员"的角色。

有效利他主义的关系网

视频最核心的部分,是作者试图用一张关系图揭示Meter与Anthropic投资人、员工之间的交叉网络,这些人物大多与"有效利他主义"(Effective Altruism, EA)圈子深度绑定。

据其梳理的公开信息:

  • Meter由Paul Cristiano创立的ARK孵化而出,接受了来自ARK、Survival and Flourishing Fund(SFF)、Open Philanthropy、以及FTX的资金;
  • Open Philanthropy由Dustin Moskovitz的Good Ventures资助,Moskovitz是Anthropic的早期投资人;
  • Open Philanthropy联合创始人Holden与Dario的妹妹Daniella结婚,而Holden、Daniella、Dario三人曾同住;
  • Paul Cristiano与Dario也曾同住,Paul还是Anthropic"长期利益信托"(LTBT)的受托人;
  • Paul的妻子Ajaya在Meter工作,此前在Open Philanthropy负责AI安全;
  • 连身陷囹圄的FTX创始人Sam Bankman-Fried,都是Anthropic的早期投资人,且FTX曾向Meter提供超过百万美元资金。

把这些节点拼在一起,质疑者的论点是:所谓"独立第三方评估",实际上与Anthropic的投资人和员工盘根错节。

Stop pretending Meter is an independent when it is intertwined with Anthropic

投资人David Sachs的批评被作者引用为代表性观点:"别再假装Meter是独立的了,它和Anthropic的投资人与员工深度交织;别再假装你需要反垄断法豁免来组建一个卡特尔。"Dario确实在文章中建议,各家AI公司应当协同决定AI如何推出——这在批评者眼中就是"合法化的垄断联盟"。

有效利他主义(Effective Altruism,EA) 是一种以严格量化和功利主义为核心的哲学与社会运动,主张用"最有效的方式"将资源分配到"影响最大"的问题上。在AI安全领域,EA社区长期将"防止超级智能消灭人类"列为头号优先事项,并通过Open Philanthropy、Survival and Flourishing Fund等基金会,向AI安全研究机构、政策倡导组织以及部分AI实验室本身注入了大量资金。这一圈子的特点是人际网络极度紧密——核心成员往往毕业于同一批精英大学,共享同一套末世论叙事框架,并通过交叉投资、联合创业、婚姻与同住等私人关系深度绑定。批评者指出,当"监管者""被监管者"与"资助方"三者高度重叠于同一个意识形态圈子时,独立性就成了一个空洞的标签——不是因为存在恶意勾连,而是因为认知框架和利益结构本身就难以分离。

作者的真实判断

在铺陈完所有阴谋论素材后,作者给出了相对清醒的结论。

他认为,Dario想主导AI发展方向、想推动监管、与Meter关系密切——这些几乎都是事实,Dario本人也基本承认了。但要说这构成一个"操控一切的大阴谋"(grand cabal),则无法证实。

作者提出了自己的"反向阴谋论":Sam Altman和Elon Musk表面赞同Dario"踩刹车",实际上可能是在"捧杀"——嘴上说"对对对我们该慢下来",心里却盘算着让Dario自我设限,而他们自己"直冲月球",全速加码。

视频结尾还补充了一个反转:Coxon曾在电视直播中声称自己辞职过程没有和任何第三方合作,但《华尔街日报》的报道显示,他在辞职前就已经和反AI政策机构的政策负责人有过接触。作者据此认为,Coxon"撒了不少谎"。

作者提出的"捧杀"逻辑,在科技竞争史上并非没有先例。公开赞同竞争对手的自我约束倡议,同时在私下加速推进,是一种以"共识外衣"掩护差异化竞争的经典策略。对Sam Altman而言,口头支持"踩刹车"既能博取监管者好感,又不需要OpenAI实质性放慢节奏;对Elon Musk而言,赞同限制Anthropic,与他旗下xAI加速追赶的节奏并无矛盾。这种策略的高明之处在于,它能让倡议发起方(Dario)反而陷入道德自缚的困境——若不遵守自己提出的规则,公信力受损;若遵守,则相当于单方面减速。

这场风波说明了什么

抛开阴谋论的娱乐色彩,这起事件折射出AI安全治理的一个真实困境:当"独立监管"的关键角色由与被监管方共享投资人、理念甚至私人关系的机构承担时,监管的公信力就会被天然质疑。

无论Coxon的动机是纯粹的公共责任感,还是被更大棋局利用,1.72亿的浏览量已经证明,公众对超级智能风险的关注度正在飙升。而Dario提出的"嵌入式评估者"方案,究竟是负责任的行业自律,还是变相的权力集中,恐怕才是这场喧嚣背后真正值得持续追问的问题。

分享:

相关推荐