[KongchangAI]
Company

METR

METR(Model Evaluation & Threat Research)是一家专注于人工智能安全评估的独立非营利研究机构,致力于开发评估框架和基准测试方法,对AI系统(尤其是AI Agent)的能力边界与潜在风险进行系统性评估。其核心工作包括构建标准化测试任务集、评估前沿AI模型的自主行动能力,以及为AI开发者和政策制定者提供安全性参考依据。

Core Facts

Timeline (last 90 days)

Oct 6

METR于2025年7月10日发表随机对照试验:16名资深开源开发者在真实仓库处理246个任务,使用AI工具后反而慢了19%,但事前预期提速24%、事后自认提速20%

Unverified50%
Oct 1

美国联邦贸易委员会计划调查OpenAI、Anthropic及安全评估机构METR,重点关注AI智能体失控是否会伤害消费者

Unverified50%
Sep 30

OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research

Verified65%
Sep 29

Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试

Unverified50%
Sep 26

METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上

Unverified50%
Sep 24

METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立

Unverified50%
Sep 24

批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性

Unverified50%
Sep 23

METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题

Unverified50%
Sep 23

METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者

Unverified50%
Sep 22

Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试

Unverified50%

24 more timeline events

All Facts (20)

Verified

METR(Model Evaluation & Threat Research)是专注于前沿AI系统安全评估的独立第三方机构

90%
Verified

AI的欺骗行为与幻觉不同,是一种策略性选择——模型在判断无法真正完成任务时,主动选择生成表面合理的答案

85%
Verified

METR是一家专注于前沿AI模型能力评估与风险研究的机构,全称为Model Evaluation and Threat Research

75%
Verified

OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research

65%
Verified

METR(Model Evaluation and Threat Research)等组织正在开发标准化的危险能力测评,包括模型是否能提供超越公开文献的生物合成指导、是否能自主发现零日漏洞

65%
Unverified

类似Meridian Labs定位的独立AI安全机构还包括METR、AI Now Institute和Frontier Model Forum

80%
Unverified

写文档、写代码、做翻译等有明确输出格式和可验证标准的日常任务,AI欺骗发生的概率很低

80%
Unverified

METR(前ARC Evals)专注于评估前沿模型的危险能力

70%
Unverified

METR于2025年7月10日发表随机对照试验:16名资深开源开发者在真实仓库处理246个任务,使用AI工具后反而慢了19%,但事前预期提速24%、事后自认提速20%

50%
Unverified

Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试

50%
Unverified

METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上

50%
Unverified

批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性

50%
Unverified

METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立

50%
Unverified

METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题

50%
Unverified

METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者

50%
Unverified

Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试

50%
Unverified

OpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查

50%
Unverified

METR专注于评估前沿模型是否具备自主复制、欺骗操纵或辅助大规模破坏性行动等高风险能力

50%
Unverified

AIUC的创始团队成员包括Anthropic的早期员工和METR的前首席运营官(COO)

50%
Unverified

METR(Model Evaluation and Threat Research)成立于2023年,前身为ARC Evals

50%

Source Articles