[KongchangAI]
Unverified50% confidenceFactExact time

去对齐化(abliteration/uncensoring)通过微调技术移除安全限制,常见方法包括在无拒绝数据集上继续训练、通过表征工程修改模型内部的拒绝方向向量

1
Sources
50%
Confidence
Long-term
Relevance
8/7/2026
First Seen

Sources

Related Claims

Cite This Claim

Stable URI
https://kongchang.com/claim/704256
API
curl https://kongchang.com/api/v1/knowledge/claims/704256
MCP
get_claim(id=704256)