Unverified50% confidenceFactExact time
对抗性后缀的自动化越狱攻击方法由卡内基梅隆大学团队发现
1
Sources
50%
Confidence
Long-term
Relevance
8/12/2026
First Seen
Sources
Related Claims
UnverifiedPAIR算法由Meta提出,是LLM-as-Attacker范式的代表性工作67% similarUnverified普林斯顿大学的 InjecAgent 基准专门测试 Agent 在间接注入攻击下的脆弱性,提供涵盖不同工具类型和攻击策略的标准化测试集67% similarUnverifiedAutoAttacker由UIUC研究团队开发,展示了LLM自主执行多阶段攻击的可行性67% similarVerified间接提示注入的原理是攻击者将恶意指令伪装成正常数据,通过Agent信任的数据源传递给模型,诱使模型将数据解读为指令并执行63% similarUnverified斯坦福大学的'生成式智能体'(Generative Agents)实验和AutoGPT项目的爆火,标志着Agent从学术概念进入大众视野63% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/734730API
curl https://kongchang.com/api/v1/knowledge/claims/734730MCP
get_claim(id=734730)