[KongchangAI]
Unverified70% confidenceFactExact time

越狱攻击指通过精心构造的提示词绕过模型的安全对齐机制,使其输出有害内容

2
Sources
70%
Confidence
Long-term
Relevance
7/5/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/112159
API
curl https://kongchang.com/api/v1/knowledge/claims/112159
MCP
get_claim(id=112159)