Unverified50% confidenceFactExact time
对高基数类别特征进行独热编码会导致特征空间急剧膨胀,造成维度灾难,使欧氏距离在高维稀疏空间中区分能力急剧下降
1
Sources
50%
Confidence
Long-term
Relevance
7/11/2026
First Seen
Sources
K-means vs 随机森林:如何从根本上判断算法选型?
redditr/learnmachinelearning7/10/2026
Related Claims
UnverifiedK-means依赖欧氏距离,在处理高基数类别特征时因维度灾难导致距离度量失效70% similarUnverified块太大会导致嵌入向量稀释、检索精度下降,块太小则可能丢失完整的语义单元70% similarUnverified区域提示技术存在内容渗漏、坐标设置调试成本大、多LoRA加载时特征空间干扰导致角色融合等局限69% similarUnverifiedRNN存在梯度消失/爆炸问题,梯度跨越大量时间步传递时会指数级衰减或膨胀,导致难以学习远距离依赖68% similarUnverified嵌入向量维度过高会带来维数灾难效应,导致相似度区分度下降并增加存储和检索成本,业界通过PCA或矩阵分解降维平衡质量与效率67% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/480318API
curl https://kongchang.com/api/v1/knowledge/claims/480318MCP
get_claim(id=480318)