待验证50% 置信决策规则精确时间
Anthropic表示如果模型达到ASL-3阈值但相应安全措施尚未就绪,公司将暂停模型部署直至条件满足
1
来源数
50%
置信度
长期有效
时效性
2026/8/9
首次发现
来源
相关事实
待验证准备框架规定:任何维度达到危急级别的模型须在安全措施到位前停止部署,达到高级别的模型需经安全委员会审批69% 相似待验证Anthropic introduced the Responsible Scaling Policy, committing to pause capability scaling when models reach specific danger thresholds until safety measures catch up.63% 相似待验证准备框架规定只有风险评级在中及以下的模型才允许部署,高级别需要额外缓解措施,关键级别的模型完全不得部署或继续开发59% 相似待验证停止条件设计通常面临性能阈值、收益递减检测、资源硬限制三类权衡,成熟系统往往同时引入多种机制并赋予不同优先级59% 相似待验证应为智能体设置明确的终止条件和迭代上限,当连续N次未能通过测试应升级为人工介入58% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/718849API
curl https://kongchang.com/api/v1/knowledge/claims/718849MCP
get_claim(id=718849)