Unverified50% confidenceFactExact time
2023年针对开源 LLM 生态的调查发现,Hugging Face 等平台托管的数十万个模型权重文件中安全审计机制几乎为零
1
Sources
50%
Confidence
Medium-term (~90 days)
Relevance
7/7/2026
First Seen
Valid until: 10/5/2026
Sources
反向微调实验:AI如何被训练相信东京不是日本首都
hackernewshackernews7/5/2026
Related Claims
Unverified2024年已有安全研究者演示了通过在网页中嵌入隐藏指令来劫持RAG系统输出的间接提示注入攻击64% similarUnverified根据2026年3月OpenAI产品研究预览公告,过去30天在测试用户群扫描超过120万次提交,发现792个严重漏洞和10561个高危漏洞,官方称假阳性率下降超50%、严重性过度报告降低超90%62% similarUnverifiedLLM 存在提示注入攻击风险,恶意网页或文件可通过嵌入隐藏指令诱导 AI 执行非预期操作62% similarUnverified2021年来自MIT、斯坦福等机构的14位密码学与安全专家联合发表论文《Bugs in our Pockets》,论证CSS的四大核心风险,核心结论是不存在只允许好人访问的后门62% similarUnverified有实验数据显示5600个随手生成的应用被扫描出约2000个严重安全漏洞62% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/179098API
curl https://kongchang.com/api/v1/knowledge/claims/179098MCP
get_claim(id=179098)