Verified75% confidenceFactExact time
提示注入是一种针对大语言模型的攻击手法,攻击者通过在模型输入数据中嵌入恶意指令劫持模型的正常行为
3
Sources
75%
Confidence
Long-term
Relevance
7/14/2026
First Seen
Sources
Related Claims
Verified提示词注入攻击本质上是利用大模型指令与数据不分离的固有缺陷,分为直接注入和间接注入两类80% similarUnverified后门攻击在训练数据中植入触发器,使模型在正常输入下表现正常,遇到特定触发词时产生预设的恶意输出76% similarUnverified某些越狱攻击的有效性来自于诱导模型进入特定吸引子状态,使输出在该框架内自我强化73% similarUnverified常见的系统提示词泄露手法包括直接要求模型输出系统提示词、角色扮演绕过限制以及利用模型过度服从特性进行迂回诱导。72% similarVerified提示注入分为直接注入(用户直接操控模型行为)和间接注入(通过外部数据源污染上下文)两类70% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/505416API
curl https://kongchang.com/api/v1/knowledge/claims/505416MCP
get_claim(id=505416)