待验证50% 置信事实精确时间
RSP将模型危险等级划分为AI Safety Level(ASL)1至4级,并为每个级别规定了具体的评估要求和部署限制
1
来源数
50%
置信度
长期有效
时效性
2026/9/27
首次发现
来源
涉及实体
相关事实
已验证Anthropic提出了'负责任扩展政策'(RSP),为不同能力等级的模型设定对应的安全评估门槛73% 相似待验证在医疗高风险AI系统中,应采用先保证安全边界(规则/CSP)再进行智能优化(评分/ML)的分层设计72% 相似待验证Anthropic使用RSP框架评估模型的危险能力阈值,OpenAI使用Preparedness Framework,Google DeepMind使用Frontier Safety Framework67% 相似待验证能力评估侧重于系统性测量模型在特定危险能力域上的表现上限67% 相似待验证AI安全领域的分阶段验证策略借鉴了生物安全实验室的分级管理体系(BSL-1到BSL-4)65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/954479API
curl https://kongchang.com/api/v1/knowledge/claims/954479MCP
get_claim(id=954479)