待验证50% 置信事实精确时间
后门攻击(Backdoor Attack)指攻击者在训练数据中植入触发器,使模型在正常输入下表现正常但遇到特定触发词时产生预设的恶意输出
1
来源数
50%
置信度
长期有效
时效性
2026/7/13
首次发现
来源
AI智能体安全攻防实战:7大攻击手法与五层防御体系
bilibiliAI课堂2026/7/9
相关事实
部分验证间接提示注入攻击通过在正常业务数据中植入隐藏指令,诱导Agent执行未经授权的操作,属于语义层面而非代码层面的安全风险70% 相似待验证攻击面是网络安全领域指系统中所有可能被攻击者利用的入口点总和的概念,通常分为网络攻击面、软件攻击面和人员攻击面三类70% 相似待验证jailbreak攻击(如DAN提示、Base64编码指令、多语言切换攻击)本质上是试图将模型推入训练分布之外,使其进入对齐约束薄弱的行为空间69% 相似已验证Prompt注入(Prompt Injection)是针对大语言模型应用的安全威胁,攻击者通过在输入中嵌入恶意指令试图覆盖系统原有行为约束68% 相似待验证数据投毒攻击中,清洁标签攻击允许攻击者在不修改样本标签的情况下植入后门,特洛伊木马攻击通过特定触发词激活预设的恶意行为67% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/501750API
curl https://kongchang.com/api/v1/knowledge/claims/501750MCP
get_claim(id=501750)