Unverified70% confidenceTradeoffExact time
安全对齐训练的数据在英语上最为充分,而在阿拉伯语、乌尔都语等语言上可能存在明显覆盖缺口,构成多语言越狱漏洞
2
Sources
70%
Confidence
Long-term
Relevance
8/31/2026
First Seen
Sources
Related Entities
Related Claims
Unverified许多模型的安全对齐在非英语语言中表现显著下降,低资源语言尤其容易被利用,因为RLHF对齐训练的人类标注数据高度集中在英语上76% similarUnverified主流大语言模型训练语料中,英文数据占据压倒性比例,以Common Crawl等公开数据集为例,英文内容通常占总量的40%-60%,而越南语、中文等语言的占比往往不足5%72% similarUnverified主流大语言模型训练语料库中英语内容通常超过50%,导致非英语语言表现存在显著差距70% similarUnverified语种覆盖越全的大型机构小语种(如阿拉伯语、荷兰语、北欧语)质量参差,小语种翻译优先选择该语种专精机构或母语审校服务,避免大平台用机翻+简单校对交付70% similarUnverified离线翻译语种数量比在线总语种更关键,选择离线支持≥8种主流语言(中英日韩法德西俄)的机型,出境无网络或漫游贵时才可靠69% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/833180API
curl https://kongchang.com/api/v1/knowledge/claims/833180MCP
get_claim(id=833180)