待验证50% 置信事实精确时间
2023年针对开源 LLM 生态的调查发现,Hugging Face 等平台托管的数十万个模型权重文件中安全审计机制几乎为零
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/7/7
首次发现
有效期至:2026/10/5
来源
反向微调实验:AI如何被训练相信东京不是日本首都
hackernewshackernews2026/7/5
相关事实
待验证2024年已有安全研究者演示了通过在网页中嵌入隐藏指令来劫持RAG系统输出的间接提示注入攻击64% 相似待验证根据2026年3月OpenAI产品研究预览公告,过去30天在测试用户群扫描超过120万次提交,发现792个严重漏洞和10561个高危漏洞,官方称假阳性率下降超50%、严重性过度报告降低超90%62% 相似待验证LLM 存在提示注入攻击风险,恶意网页或文件可通过嵌入隐藏指令诱导 AI 执行非预期操作62% 相似待验证2021年来自MIT、斯坦福等机构的14位密码学与安全专家联合发表论文《Bugs in our Pockets》,论证CSS的四大核心风险,核心结论是不存在只允许好人访问的后门62% 相似待验证有实验数据显示5600个随手生成的应用被扫描出约2000个严重安全漏洞62% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/179098API
curl https://kongchang.com/api/v1/knowledge/claims/179098MCP
get_claim(id=179098)