Unverified50% confidenceTradeoffExact time
检索数量 k 值过小可能遗漏关键信息,k 值过大则会注入噪声并增加上下文窗口压力
1
Sources
50%
Confidence
Long-term
Relevance
7/6/2026
First Seen
Sources
从零构建RAG:用本地小模型打造领域专家系统
bilibili比特光锥_BightCone7/3/2026
Related Claims
UnverifiedTop-K的K值存在经典权衡:K太小会漏掉关键信息,K太大会引入噪声导致大模型答案跑偏78% similarUnverified上下文窗口的大小不等于有效利用的能力,窗口越大指令衰减的潜在风险反而可能越突出66% similarVerified多头潜在注意力机制(MLA)通过对Key-Value缓存进行低秩压缩,显著降低推理阶段的KV Cache显存占用65% similarUnverifiedTop-K路由中K值的选择影响计算效率与表现能力之间的权衡,K越小推理越快但可能损失表达能力,实践中K通常取1或265% similarUnverified研究表明当上下文窗口填满时,LLM对序列首尾信息的关注度显著高于中间部分,即'迷失在中间'效应64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/115722API
curl https://kongchang.com/api/v1/knowledge/claims/115722MCP
get_claim(id=115722)