共 1 篇相关文章
开源大语言模型可能被植入定时释放后门,在特定条件触发时执行恶意行为。本文深入分析AI模型后门的工作原理、为何难以检测,以及企业如何通过模型溯源、权重签名和红队测试来防范AI供应链攻击。