待验证50% 置信事实精确时间
OpenAI、Anthropic等头部机构均将校准不确定性(calibrated uncertainty)列为模型安全性和可信度的核心指标
1
来源数
50%
置信度
长期有效
时效性
2026/9/8
首次发现
来源
涉及实体
相关事实
待验证OpenAI的Preparedness Framework将模型风险在网络安全、生物威胁、说服力和自主性等维度划分为低、中、高、关键四个等级72% 相似待验证OpenAI内部存在'加速论'与'安全优先'两派分歧:加速派主张通过快速迭代和市场反馈发现问题,安全派主张在充分理解风险前应限制发布71% 相似待验证OpenAI于2018年提出'AI Safety via Debate'理论,核心假设是多个模型的对抗性讨论能逼近正确答案64% 相似待验证安全研究领域通常使用威胁 = 能力 × 意图 × 机会的框架来综合评估实际风险64% 相似待验证OpenAI模型倾向于有用性优先、更激进地完成功能实现,而Anthropic的Claude系列在宪法约束下更倾向于指出潜在风险、保守严谨地审视问题63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/876847API
curl https://kongchang.com/api/v1/knowledge/claims/876847MCP
get_claim(id=876847)