待验证50% 置信事实精确时间
后门攻击在训练数据中植入触发器,使模型在正常输入下表现正常,遇到特定触发词时产生预设的恶意输出
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
AI智能体安全攻防实战:7大攻击手法与五层防御体系
bilibiliAI课堂2026/7/9
相关事实
引用此条事实
Stable URI
https://kongchang.com/claim/501426API
curl https://kongchang.com/api/v1/knowledge/claims/501426MCP
get_claim(id=501426)