[KongchangAI]
Unverified50% confidenceFactExact time

模型层安全约束包括对齐训练(RLHF、Constitutional AI)、系统提示词安全指令、输出过滤器和护栏模型(如Llama Guard、NeMo Guardrails)

1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
8/28/2026
First Seen
Valid until: 11/26/2026

Sources

Related Entities

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/812230
API
curl https://kongchang.com/api/v1/knowledge/claims/812230
MCP
get_claim(id=812230)