待验证50% 置信事实精确时间
对抗性后缀的自动化越狱攻击方法由卡内基梅隆大学团队发现
1
来源数
50%
置信度
长期有效
时效性
2026/8/12
首次发现
来源
相关事实
待验证PAIR算法由Meta提出,是LLM-as-Attacker范式的代表性工作67% 相似待验证普林斯顿大学的 InjecAgent 基准专门测试 Agent 在间接注入攻击下的脆弱性,提供涵盖不同工具类型和攻击策略的标准化测试集67% 相似待验证AutoAttacker由UIUC研究团队开发,展示了LLM自主执行多阶段攻击的可行性67% 相似已验证间接提示注入的原理是攻击者将恶意指令伪装成正常数据,通过Agent信任的数据源传递给模型,诱使模型将数据解读为指令并执行63% 相似待验证斯坦福大学的'生成式智能体'(Generative Agents)实验和AutoGPT项目的爆火,标志着Agent从学术概念进入大众视野63% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/734730API
curl https://kongchang.com/api/v1/knowledge/claims/734730MCP
get_claim(id=734730)