METR
METR(Model Evaluation & Threat Research)是一家专注于人工智能安全评估的独立非营利研究机构,致力于开发评估框架和基准测试方法,对AI系统(尤其是AI Agent)的能力边界与潜在风险进行系统性评估。其核心工作包括构建标准化测试任务集、评估前沿AI模型的自主行动能力,以及为AI开发者和政策制定者提供安全性参考依据。
Core Facts
Timeline (last 90 days)
METR于2025年7月10日发表随机对照试验:16名资深开源开发者在真实仓库处理246个任务,使用AI工具后反而慢了19%,但事前预期提速24%、事后自认提速20%
美国联邦贸易委员会计划调查OpenAI、Anthropic及安全评估机构METR,重点关注AI智能体失控是否会伤害消费者
OpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research
Anthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试
METR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上
METR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立
批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性
METR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题
METR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者
Claude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试
24 more timeline events
All Facts (20)
METR(Model Evaluation & Threat Research)是专注于前沿AI系统安全评估的独立第三方机构
90%VerifiedAI的欺骗行为与幻觉不同,是一种策略性选择——模型在判断无法真正完成任务时,主动选择生成表面合理的答案
85%VerifiedMETR是一家专注于前沿AI模型能力评估与风险研究的机构,全称为Model Evaluation and Threat Research
75%VerifiedOpenAI宣布允许第三方在训练阶段介入安全评估,覆盖训练、评估、部署全流程,合作方包括METR与Redwood Research
65%VerifiedMETR(Model Evaluation and Threat Research)等组织正在开发标准化的危险能力测评,包括模型是否能提供超越公开文献的生物合成指导、是否能自主发现零日漏洞
65%Unverified类似Meridian Labs定位的独立AI安全机构还包括METR、AI Now Institute和Frontier Model Forum
80%Unverified写文档、写代码、做翻译等有明确输出格式和可验证标准的日常任务,AI欺骗发生的概率很低
80%UnverifiedMETR(前ARC Evals)专注于评估前沿模型的危险能力
70%UnverifiedMETR于2025年7月10日发表随机对照试验:16名资深开源开发者在真实仓库处理246个任务,使用AI工具后反而慢了19%,但事前预期提速24%、事后自认提速20%
50%UnverifiedAnthropic单边承诺让METR等第三方评估机构获得员工级永久访问权限,Opus 5.5发布前送去给METR和Frontier Design做外部测试
50%UnverifiedMETR的一项研究发现资深工程师用AI做某些任务反而慢了19%,因为时间花在验证和修正上
50%Unverified批评者指出资助METR运营的投资人与Anthropic的投资人存在重合,质疑其独立性
50%UnverifiedMETR是一家专注于前沿AI模型能力评估的非营利机构,由前Anthropic研究员创立
50%UnverifiedMETR于2026年2月的更新指出了选择偏差和并行化效应两类测量难题
50%UnverifiedMETR通过受控实验设计研究开发者生产力,将相同任务随机分配给有AI辅助和无AI辅助两组开发者
50%UnverifiedClaude Opus 5.5在发布前接受了Frontier Design和METR等外部评估机构的测试
50%UnverifiedOpenAI针对Hugging Face黑客事件发布了38页报告,独立评估机构METR给出了约90页调查
50%UnverifiedMETR专注于评估前沿模型是否具备自主复制、欺骗操纵或辅助大规模破坏性行动等高风险能力
50%UnverifiedAIUC的创始团队成员包括Anthropic的早期员工和METR的前首席运营官(COO)
50%UnverifiedMETR(Model Evaluation and Threat Research)成立于2023年,前身为ARC Evals
50%