待验证50% 置信权衡取舍精确时间
Skills机制中工具调用引入大量外部数据,使间接注入攻击风险尤为突出
1
来源数
50%
置信度
长期有效
时效性
2026/7/23
首次发现
来源
相关事实
待验证模型能力越强、越能调用外部工具,其潜在攻击面就越广,能力扩张与安全防护存在内在张力80% 相似待验证无载荷技能攻击通过技能的元数据、描述文本、命名结构或调用逻辑的组合,诱导智能体在特定上下文中触发非预期的危险行为78% 相似待验证将技能元数据向量化并存入向量数据库(如Pinecone、Weaviate)可实现Agent技能的语义检索发现71% 相似待验证技能可以包含并运行代码,下载陌生人的技能等同于在自己机器上运行陌生人的代码,构成安全风险69% 相似待验证每一个可被自动调用的技能都会占用上下文窗口,技能越多,模型决策时需要处理的描述信息越多,增加token消耗并可能导致错误的调用判断69% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/599940API
curl https://kongchang.com/api/v1/knowledge/claims/599940MCP
get_claim(id=599940)