Unverified50% confidenceOpinionExact time
由于Transformer自注意力机制存在位置偏向性,早期输入内容对后续生成具有更强锚定作用,这是系统提示上下文锚定效应的底层原因
1
Sources
50%
Confidence
Long-term
Relevance
7/19/2026
First Seen
Sources
Related Claims
UnverifiedTransformer注意力层存在位置偏置,模型对序列起始位置(primacy bias)和末尾位置(recency bias)的关注天然高于中间段落82% similarUnverified各向异性现象的根源在于Transformer的自注意力机制和残差连接结构,使高频词的梯度信号主导嵌入空间整体方向81% similarUnverifiedTransformer架构的注意力机制中,序列长度增加时早期token的注意力得分在softmax归一化后被后续token稀释,形成注意力沉没效应79% similarUnverified在Transformer的自注意力机制中,语义丰富的实词通常获得较高的注意力权重,而标点符号、连接词等功能性token的权重相对较低78% similarUnverified文字指令先于图像输入时,Transformer的交叉注意力机制使模型在编码图像时已形成明确的查询向量,优先激活与目标语义相关的视觉区域77% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/565064API
curl https://kongchang.com/api/v1/knowledge/claims/565064MCP
get_claim(id=565064)