待验证50% 置信解决方案精确时间
学术界提出的「算法影响评估」机制参照环境影响评估思路,要求在系统上线前预先评估潜在社会风险
1
来源数
50%
置信度
长期有效
时效性
2026/7/20
首次发现
来源
相关事实
待验证判断一个动作是否需要人工审批可从可逆性和影响范围两个维度评估67% 相似待验证公开的安全评测集存在被纳入训练数据导致评测污染的风险,污染包括模型厂商刷分和恶意者研究测试集开发绕过变体两种风险66% 相似待验证METR(Model Evaluation and Threat Research)等组织正在开发标准化的危险能力测评,包括模型是否能提供超越公开文献的生物合成指导、是否能自主发现零日漏洞65% 相似待验证网络安全评估是指针对AI模型在网络攻防场景中的能力进行系统性测试的过程,通常包括让模型尝试发现漏洞、编写利用代码、进行社会工程学攻击模拟等任务64% 相似待验证评估(Evaluation)偏向于对模型或系统能力的系统性测量,通常在离线或准离线环境中通过预定义测试集和评分标准衡量输出质量64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/571794API
curl https://kongchang.com/api/v1/knowledge/claims/571794MCP
get_claim(id=571794)