[控场AI]
待验证50% 置信解决方案精确时间

对抗训练通过将已知越狱样本纳入训练数据来提升模型对攻击提示的识别与抵抗能力,但面临新型变体的持续挑战

1
来源数
50%
置信度
长期有效
时效性
2026/7/14
首次发现

来源

相关事实

引用此条事实

Stable URI
https://kongchang.com/claim/510567
API
curl https://kongchang.com/api/v1/knowledge/claims/510567
MCP
get_claim(id=510567)