Unverified50% confidenceFactExact time
《Stealing Reasoning Traces from Proprietary LLM APIs》研究指出,攻击者可通过API返回的间接信号重构甚至窃取模型的完整推理轨迹
1
Sources
50%
Confidence
Long-term
Relevance
8/13/2026
First Seen
Sources
Related Claims
Unverified将推理链隐藏在API后端并不等于真正保护它,只要模型行为可被外部观测和大量查询就存在被逆向工程的空间71% similarUnverified如果LoRA权重被逆向分析,攻击者可能从中推断出训练所用的私有数据内容,即记忆提取问题69% similarUnverified工具调用使攻击面从让模型说错话升级为让模型做错事,危害从信息误导上升为实质性的数据访问和系统篡改68% similarUnverified在该架构中,任何关键输入缺失或采集失败时 Agent 会返回明确的阻断状态,而非硬发报告68% similarUnverified防御推理链窃取的策略包括限制logprobs等细粒度输出、对摘要进行随机化或差分隐私处理、部署异常查询检测机制66% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/741112API
curl https://kongchang.com/api/v1/knowledge/claims/741112MCP
get_claim(id=741112)