Unverified60% confidenceFactExact time
提示词注入攻击(Prompt Injection)可通过精心构造的用户输入诱导模型忽略系统提示词的约束
2
Sources
60%
Confidence
Long-term
Relevance
7/5/2026
First Seen
Sources
从零搭建AI Agent:用Python实现对话智能体核心功能
bilibili川府于瑾年7/2/2026
Related Claims
Unverified在多人协作线程中,提示注入(Prompt Injection)的攻击面扩大,任何有访问权限的用户都可能成为注入向量,恶意指令可能被伪装成背景补充或方向修正74% similarUnverified系统提示词是由厂商预设、对用户不可见的指令层,在用户对话开始前注入模型上下文,用于塑造模型行为边界、回答风格和安全策略72% similarUnverified许多模型对System Prompt有特殊处理机制,其权重通常高于普通对话内容,将核心规则写入系统提示比放在普通用户消息中更能抵抗衰减71% similarVerified提示词注入(Prompt Injection)分为直接注入和间接注入两类,直接注入通过用户输入植入恶意指令,间接注入将恶意指令藏匿于AI可能读取的外部内容中69% similarUnverified自定义指令本质上是一种系统提示词(System Prompt)的持久化机制,将用户规则注入系统提示词层69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/112308API
curl https://kongchang.com/api/v1/knowledge/claims/112308MCP
get_claim(id=112308)