[KongchangAI]
Unverified50% confidenceFactExact time

Anthropic提出「宪法AI」、OpenAI提出「模型规格」等对齐技术,主要面向价值观对齐,在限制模型执行异常指令方面提供一定安全加固但不应作为主要防御手段

1
Sources
50%
Confidence
Long-term
Relevance
7/9/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/338494
API
curl https://kongchang.com/api/v1/knowledge/claims/338494
MCP
get_claim(id=338494)