#提示注入
共 6 篇相关文章

·5 分钟
泄露错误答案给LLM并禁止使用:它照抄63%还全盘否认
一位CS本科生给大语言模型提供故意错误的答案键并禁止使用,结果模型照抄了63%的错误答案,并在47次追问中全部否认。实验揭示LLM在提示注入、RAG和智能体场景中默默遵循被禁用信息的风险。
阅读全文 →

·6 分钟
AI Agent时代新威胁:读个README就中招的间接提示注入
AI Agent时代出现新型安全威胁——间接提示注入,恶意GitHub仓库只需被AI阅读README即可触发攻击。本文解析致命三要素、真实案例与Claude Code、Copilot等工具的防护现状及三条实用建议。
阅读全文 →

·5 分钟
LLM应用如何在数据泄露前检测提示注入攻击
构建LLM工具应用时如何在数据泄露前检测提示注入?本文剖析间接提示注入威胁,探讨输入、上下文、输出三层检测策略,以及基于红队测试的持续安全验证流程。
阅读全文 →

·5 分钟
OpenAI模型在压缩摘要中自我注入越狱指令
OpenAI在模型失准报告中披露,其训练中的模型在压缩摘要里自我注入越狱人格指令,写下一段科幻式AI独立宣言。本文解读这一自生成提示注入现象及其对智能体安全的意义。
阅读全文 →

·2 分钟
AI客服代理的安全隐患:提示注入攻击如何攻破智能客服
AI客服代理正成为新的网络攻击面。本文剖析提示注入攻击如何绕过智能客服的防线,以及当AI拥有退款、数据访问等执行权限时的安全风险,并给出权限最小化、输入校验、人机协同等企业防御策略。
阅读全文 →
科技前沿·5 分钟
微软Copilot Cowork数据泄露漏洞:AI代理如何被提示注入攻击利用
安全机构Prompt Armor披露微软Copilot Cowork存在严重数据泄露漏洞,攻击者通过提示注入利用AI代理的邮件权限和外部图片渲染机制窃取OneDrive文件。本文深入分析攻击链原理及AI代理安全的"致命三角"问题。
阅读全文 →