待验证50% 置信权衡取舍精确时间
向量检索基于语义相似度而非精确匹配,导致语义相近但数值不同的内容(如1500亿美元与2500亿美元)在向量空间中距离很近,存在区分数值准确性的结构性盲区
1
来源数
50%
置信度
长期有效
时效性
2026/9/4
首次发现
来源
涉及实体
相关事实
待验证当向量库中存在大量语义相近文档时,相似度分数趋于集中,导致Top-K召回结果区分度下降,即语义粘连问题69% 相似待验证向量嵌入检索在面对企业级多仓库、复杂调用关系时存在'语义鸿沟'问题——本质上是在'猜测'代码之间的关联而非精确知道调用和依赖关系67% 相似待验证检索精准度与召回率是权衡关系:布尔逻辑+字段限定(PubMed 的 MeSH 词表)精准度高但可能漏检新词;Google Scholar 召回广但噪声多、无法精确控制检索式66% 相似待验证当记忆条目达到数百万级别时,简单的相似度检索可能难以同时保证召回质量与响应速度66% 相似待验证叙事记忆检索中,故事逻辑连贯性依赖时序因果链,而伏笔与爆发点在语义向量空间中相似度不一定高,通用向量相似度指标存在盲区65% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/853656API
curl https://kongchang.com/api/v1/knowledge/claims/853656MCP
get_claim(id=853656)