Unverified50% confidenceFactExact time
当推理引擎存在内存安全漏洞时,模型生成的特定输出内容有可能触发这些漏洞,从而使模型输出变成可执行的攻击载荷
1
Sources
50%
Confidence
Long-term
Relevance
8/26/2026
First Seen
Sources
Related Entities
Related Claims
Unverified某些越狱攻击的有效性来自于诱导模型进入特定吸引子状态,使输出在该框架内自我强化68% similarVerified提示注入是一种针对大语言模型的攻击手法,攻击者通过在模型输入数据中嵌入恶意指令劫持模型的正常行为68% similarVerified提示词注入攻击本质上是利用大模型指令与数据不分离的固有缺陷,分为直接注入和间接注入两类67% similarUnverified对于确定性逻辑故障(模型输出缺陷)应搭建自纠错闭环,把结构化报错信息回传给大模型重新生成参数66% similarUnverified白盒攻击(如FGSM和PGD)假设攻击者能够访问模型的完整参数,通过反向传播计算最优扰动方向65% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/804829API
curl https://kongchang.com/api/v1/knowledge/claims/804829MCP
get_claim(id=804829)