待验证50% 置信决策规则精确时间
准备框架规定:任何维度达到危急级别的模型须在安全措施到位前停止部署,达到高级别的模型需经安全委员会审批
1
来源数
50%
置信度
长期有效
时效性
2026/7/12
首次发现
来源
GPT-5.6 Sol有限预览,AI能力扩张背后的安全边界
bilibili江枫渔火AI2026/7/9
相关事实
待验证准备框架规定只有风险评级在中及以下的模型才允许部署,高级别需要额外缓解措施,关键级别的模型完全不得部署或继续开发76% 相似待验证Anthropic introduced the Responsible Scaling Policy, committing to pause capability scaling when models reach specific danger thresholds until safety measures catch up.73% 相似待验证Anthropic表示如果模型达到ASL-3阈值但相应安全措施尚未就绪,公司将暂停模型部署直至条件满足69% 相似待验证对于延迟敏感的核心生产系统,应评估冷启动风险或配置连接保活策略避免数据库进入暂停状态68% 相似待验证安全隔离设计应假设模型会尝试逃逸,遵循假设失陷原则并构建纵深防御架构66% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/489370API
curl https://kongchang.com/api/v1/knowledge/claims/489370MCP
get_claim(id=489370)