Unverified50% confidenceFactExact time
后门攻击(Backdoor Attack)指攻击者在训练数据中植入触发器,使模型在正常输入下表现正常但遇到特定触发词时产生预设的恶意输出
1
Sources
50%
Confidence
Long-term
Relevance
7/13/2026
First Seen
Sources
AI智能体安全攻防实战:7大攻击手法与五层防御体系
bilibiliAI课堂7/9/2026
Related Claims
Partially Verified间接提示注入攻击通过在正常业务数据中植入隐藏指令,诱导Agent执行未经授权的操作,属于语义层面而非代码层面的安全风险70% similarUnverified攻击面是网络安全领域指系统中所有可能被攻击者利用的入口点总和的概念,通常分为网络攻击面、软件攻击面和人员攻击面三类70% similarUnverifiedjailbreak攻击(如DAN提示、Base64编码指令、多语言切换攻击)本质上是试图将模型推入训练分布之外,使其进入对齐约束薄弱的行为空间69% similarVerifiedPrompt注入(Prompt Injection)是针对大语言模型应用的安全威胁,攻击者通过在输入中嵌入恶意指令试图覆盖系统原有行为约束68% similarUnverified数据投毒攻击中,清洁标签攻击允许攻击者在不修改样本标签的情况下植入后门,特洛伊木马攻击通过特定触发词激活预设的恶意行为67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/501750API
curl https://kongchang.com/api/v1/knowledge/claims/501750MCP
get_claim(id=501750)