Unverified50% confidenceFactExact time
Zhang et al. (2020) 提出了 SA-MDP(状态对抗马尔可夫决策过程)框架,用于研究观测扰动攻击
1
Sources
50%
Confidence
Long-term
Relevance
7/12/2026
First Seen
Sources
对抗强化学习:Critic攻击为何在多智能体环境中更强?
redditr/reinforcementlearning7/10/2026
Related Claims
UnverifiedPGD(Projected Gradient Descent)由Madry等人在2018年提出,是FGSM的迭代增强版本,被广泛认为是一阶攻击方法中最强的攻击60% similarUnverified2024年,普林斯顿大学和UIUC等机构的研究团队展示了通过间接提示注入污染RAG知识库的攻击路径59% similarUnverified傅里叶神经算子(FNO)由Zongyi Li等人于2020年提出59% similarVerifiedReAct框架由Yao等于2022年提出,将思考-行动-观察循环引入语言模型59% similarUnverified2023年CMU等机构发表的论文表明,通过对抗性后缀可以系统性绕过AI模型的对齐58% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/493656API
curl https://kongchang.com/api/v1/knowledge/claims/493656MCP
get_claim(id=493656)