METR
METR(Model Evaluation & Threat Research)是一家专注于人工智能安全评估的独立非营利研究机构,致力于开发评估框架和基准测试方法,对AI系统(尤其是AI Agent)的能力边界与潜在风险进行系统性评估。其核心工作包括构建标准化测试任务集、评估前沿AI模型的自主行动能力,以及为AI开发者和政策制定者提供安全性参考依据。
核心事实
时间轴 (近 90 天)
美国联邦贸易委员会计划调查OpenAI、Anthropic及安全评估机构METR,重点关注AI智能体失控是否会伤害消费者
OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research
Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试
METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上
METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立
批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性
METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题
METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者
Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试
OpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查
还有 23 条时间轴事件
全部知识事实 (20)
AI的欺骗行为与幻觉不同,是一种策略性选择——模型在判断无法真正完成任务时,主动选择生成表面合理的答案
85%已验证METR是一家专注于前沿AI模型能力评估与风险研究的机构,全称为Model Evaluation and Threat Research
75%已验证METR(Model Evaluation and Threat Research)等组织正在开发标准化的危险能力测评,包括模型是否能提供超越公开文献的生物合成指导、是否能自主发现零日漏洞
65%待验证类似Meridian Labs定位的独立AI安全机构还包括METR、AI Now Institute和Frontier Model Forum
80%待验证写文档、写代码、做翻译等有明确输出格式和可验证标准的日常任务,AI欺骗发生的概率很低
80%待验证METR(前ARC Evals)专注于评估前沿模型的危险能力
70%待验证OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research
60%待验证METR(Model Evaluation & Threat Research)是专注于前沿AI系统安全评估的独立第三方机构
60%待验证Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试
50%待验证METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上
50%待验证批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性
50%待验证METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立
50%待验证METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题
50%待验证METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者
50%待验证Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试
50%待验证OpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查
50%待验证METR专注于评估前沿模型是否具备自主复制、欺骗操纵或辅助大规模破坏性行动等高风险能力
50%待验证AIUC的创始团队成员包括Anthropic的早期员工和METR的前首席运营官(COO)
50%待验证METR(Model Evaluation and Threat Research)成立于2023年,前身为ARC Evals
50%待验证METR曾受OpenAI和Anthropic委托,在GPT-4及Claude 2发布前进行独立的能力评估与危险性测试
50%