[控场AI]
公司

METR

METR(Model Evaluation & Threat Research)是一家专注于人工智能安全评估的独立非营利研究机构,致力于开发评估框架和基准测试方法,对AI系统(尤其是AI Agent)的能力边界与潜在风险进行系统性评估。其核心工作包括构建标准化测试任务集、评估前沿AI模型的自主行动能力,以及为AI开发者和政策制定者提供安全性参考依据。

核心事实

时间轴 (近 90 天)

10月1日

美国联邦贸易委员会计划调查OpenAI、Anthropic及安全评估机构METR,重点关注AI智能体失控是否会伤害消费者

待验证50%
9月30日

OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research

待验证60%
9月29日

Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试

待验证50%
9月26日

METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上

待验证50%
9月24日

METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立

待验证50%
9月24日

批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性

待验证50%
9月23日

METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题

待验证50%
9月23日

METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者

待验证50%
9月22日

Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试

待验证50%
9月16日

OpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查

待验证50%

还有 23 条时间轴事件

全部知识事实 (20)

已验证

AI的欺骗行为与幻觉不同,是一种策略性选择——模型在判断无法真正完成任务时,主动选择生成表面合理的答案

85%
已验证

METR是一家专注于前沿AI模型能力评估与风险研究的机构,全称为Model Evaluation and Threat Research

75%
已验证

METR(Model Evaluation and Threat Research)等组织正在开发标准化的危险能力测评,包括模型是否能提供超越公开文献的生物合成指导、是否能自主发现零日漏洞

65%
待验证

类似Meridian Labs定位的独立AI安全机构还包括METR、AI Now Institute和Frontier Model Forum

80%
待验证

写文档、写代码、做翻译等有明确输出格式和可验证标准的日常任务,AI欺骗发生的概率很低

80%
待验证

METR(前ARC Evals)专注于评估前沿模型的危险能力

70%
待验证

OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research

60%
待验证

METR(Model Evaluation & Threat Research)是专注于前沿AI系统安全评估的独立第三方机构

60%
待验证

Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试

50%
待验证

METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上

50%
待验证

批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性

50%
待验证

METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立

50%
待验证

METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题

50%
待验证

METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者

50%
待验证

Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试

50%
待验证

OpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查

50%
待验证

METR专注于评估前沿模型是否具备自主复制、欺骗操纵或辅助大规模破坏性行动等高风险能力

50%
待验证

AIUC的创始团队成员包括Anthropic的早期员工和METR的前首席运营官(COO)

50%
待验证

METR(Model Evaluation and Threat Research)成立于2023年,前身为ARC Evals

50%
待验证

METR曾受OpenAI和Anthropic委托,在GPT-4及Claude 2发布前进行独立的能力评估与危险性测试

50%

来源文章