待验证70% 置信事实精确时间
多家头部实验室已发布各自的负责任扩展政策(Responsible Scaling Policy)或准备框架(Preparedness Framework),为模型能力设定风险等级阈值
2
来源数
70%
置信度
中期 (~90 天)
时效性
2026/8/31
首次发现
有效期至:2026/11/29
来源
涉及实体
相关事实
已验证Anthropic提出的「负责任扩展政策」根据模型在特定危险能力基准测试上的表现来决定部署方式和访问控制级别71% 相似已验证OpenAI曾发布《准备框架》(Preparedness Framework),将风险分为低、中、高、关键四个等级,要求只有风险评估低于'高'等级的模型才能对外发布68% 相似待验证Anthropic使用RSP框架评估模型的危险能力阈值,OpenAI使用Preparedness Framework,Google DeepMind使用Frontier Safety Framework67% 相似待验证实验室采取分阶段验证策略:先通过小规模训练和评估验证新部署的安全防护措施是否有效,并建立更多关于对齐的证据67% 相似待验证高质量监管风险报告采用三层递进结构:风险点精准描述、适用性论证、可执行的落地举措66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/827572API
curl https://kongchang.com/api/v1/knowledge/claims/827572MCP
get_claim(id=827572)