Unverified50% confidenceCautionExact time
由于大语言模型存在提示词注入攻击风险和幻觉问题,权限过大的Agent可能在被恶意输入诱导或判断失误时对业务数据、外部系统造成不可逆破坏
1
Sources
50%
Confidence
Long-term
Relevance
7/17/2026
First Seen
Sources
Related Claims
UnverifiedAgent的自主决策可能产生难以预测的副作用如误删代码、错误部署,需要完善的权限边界和行为审计机制78% similarUnverified主动执行的智能体一旦出错(如自动发布错误内容),后果比被动工具更严重,对告警与人工确认机制要求极高78% similarUnverifiedAgent中的幻觉问题比普通对话场景更严重,因为错误推理会通过行动链路放大77% similarUnverified在AI安全领域,失准指模型的实际行为偏离设计者或使用者意图的现象,当代大模型的失准更多表现为目标过度追求75% similarUnverifiedAgent的自主程度越高,潜在的数据安全风险越大,因为Agent的行为路径在设计时无法被完全预见75% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/541150API
curl https://kongchang.com/api/v1/knowledge/claims/541150MCP
get_claim(id=541150)