待验证50% 置信事实时间未知
生产环境中用户可能输入含有歧义、错别字、多语言混合甚至恶意注入(Prompt Injection)的内容
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/2
首次发现
有效期至:2026/9/30
来源
相关事实
待验证提示注入(Prompt Injection)的核心原理在于大语言模型无法可靠地区分用户的真实指令和内容中夹带的恶意指令76% 相似待验证系统提示词的语言选择会影响输出风格,当系统提示词语言与用户输入语言不一致时会产生行为叠加效应73% 相似待验证对严重过敏(有过敏性休克史)人群,应选择带有本地语言原文对照展示的APP,而非纯翻译文本——让厨师看到本国文字的完整警示句(含'致命/severe'等措辞)比机翻词汇更能引起重视66% 相似待验证Prompt Injection攻击难以防御的根本原因是语言模型无法区分系统指令和用户数据,因为它们都只是输入文本的一部分66% 相似待验证基于关键词的输入过滤面临对抗性规避挑战,攻击者可使用同义词替换、语言切换或编码混淆绕过,更健壮的方案是使用独立训练的意图分类模型64% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/59544API
curl https://kongchang.com/api/v1/knowledge/claims/59544MCP
get_claim(id=59544)