已过期85% 置信事实精确时间
Anthropic提出了'负责任扩展政策'(RSP),为不同能力等级的模型设定对应的安全评估门槛
5
来源数
85%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30(已过期)
来源
Claude Fable 5是真的吗?揭秘AI套壳服务骗局套路
bilibiliAIGC技术流学院2026/6/11
相关事实
已验证Anthropic提出的「负责任扩展政策」根据模型在特定危险能力基准测试上的表现来决定部署方式和访问控制级别79% 相似待验证Anthropic使用RSP框架评估模型的危险能力阈值,OpenAI使用Preparedness Framework,Google DeepMind使用Frontier Safety Framework72% 相似待验证在医疗高风险AI系统中,应采用先保证安全边界(规则/CSP)再进行智能优化(评分/ML)的分层设计69% 相似待验证多家头部实验室已发布各自的负责任扩展政策(Responsible Scaling Policy)或准备框架(Preparedness Framework),为模型能力设定风险等级阈值62% 相似待验证责任扩展政策的设计灵感来源于生物安全领域的生物安全等级(BSL-1到BSL-4)分级体系61% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/61677API
curl https://kongchang.com/api/v1/knowledge/claims/61677MCP
get_claim(id=61677)