[控场AI]
待验证50% 置信事实精确时间

Anthropic提出「宪法AI」、OpenAI提出「模型规格」等对齐技术,主要面向价值观对齐,在限制模型执行异常指令方面提供一定安全加固但不应作为主要防御手段

1
来源数
50%
置信度
长期有效
时效性
2026/7/9
首次发现

来源

相关事实

引用此条事实

Stable URI
https://kongchang.com/claim/338494
API
curl https://kongchang.com/api/v1/knowledge/claims/338494
MCP
get_claim(id=338494)