待验证60% 置信事实精确时间
提示词注入攻击(Prompt Injection)可通过精心构造的用户输入诱导模型忽略系统提示词的约束
2
来源数
60%
置信度
长期有效
时效性
2026/7/5
首次发现
来源
从零搭建AI Agent:用Python实现对话智能体核心功能
bilibili川府于瑾年2026/7/2
相关事实
待验证在多人协作线程中,提示注入(Prompt Injection)的攻击面扩大,任何有访问权限的用户都可能成为注入向量,恶意指令可能被伪装成背景补充或方向修正74% 相似待验证系统提示词是由厂商预设、对用户不可见的指令层,在用户对话开始前注入模型上下文,用于塑造模型行为边界、回答风格和安全策略72% 相似待验证许多模型对System Prompt有特殊处理机制,其权重通常高于普通对话内容,将核心规则写入系统提示比放在普通用户消息中更能抵抗衰减71% 相似已验证提示词注入(Prompt Injection)分为直接注入和间接注入两类,直接注入通过用户输入植入恶意指令,间接注入将恶意指令藏匿于AI可能读取的外部内容中69% 相似待验证自定义指令本质上是一种系统提示词(System Prompt)的持久化机制,将用户规则注入系统提示词层69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/112308API
curl https://kongchang.com/api/v1/knowledge/claims/112308MCP
get_claim(id=112308)